{"as_of":"2026-08-08T17:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:082d1927211c29727949d2717d3a2f9b55e2ebb35af442b51d40935557c94366","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:53:22.927707Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.09411/citation-record","integrity":"/paper/2506.09411/integrity","json":"/paper/2506.09411/citation-record.json","paper":"/paper/2506.09411"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:15.800997Z","title":"Vivit: A video vision transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:15.800997Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:d99e0a68671c2a761c420dd4a5cbc8c021038d49ab79c3febcca4f0b59f5d3ee","observation_id":"2d494608-6357-4805-bee5-1da70c23b98f","resolution":{"observed_at":"2026-08-07T04:53:15.800997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:35.680809Z","title":"Is space-time attention all you need for video understanding? InICML, page 4, 2021","venue":null,"work_id":"b6c1a893-56b4-4b30-9643-29ab2fe9bee2","year":2021},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:15.885477Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:bd4d6a24dd3f6020625d5c7e4a8a6f1fdfec424e694fb61ffc89889bf730cb37","observation_id":"10c2c6f3-a56d-4dba-8edb-9813b3dcae91","resolution":{"observed_at":"2026-08-07T04:53:35.768521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:35.433605Z","title":"BEDLAM: A synthetic dataset of bodies ex- hibiting detailed lifelike animated motion","venue":null,"work_id":"83b7c38a-3050-44d2-ba3d-88ff50602d57","year":2023},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:15.963253Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:5074bf86515667da27f8c6b61b4a968d9a143e270e8fda81c7a8b89fb84fcd34","observation_id":"7d1604fc-1218-4b34-b0dd-afb70d0441e4","resolution":{"observed_at":"2026-08-07T04:53:35.549393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:16.075035Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.075035Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:4216e2d692c195ecf392bc98f89fc5556edbb7e0609a528ea4c31ea188205887","observation_id":"fd93fc9b-31dd-4f87-8aa9-1e60f78d5bc4","resolution":{"observed_at":"2026-08-07T04:53:16.075035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:35.156714Z","title":"Why can’t i dance in the mall? learning to miti- gate scene bias in action recognition.Advances in Neural Information Processing Systems, 32, 2019","venue":null,"work_id":"b6ad80a8-5ae8-4b39-a94a-a36e6eebeee3","year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.152119Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:f2ce2e6cec1d7d8c78399176338b5c34947b5d30f05dee737fc42d8e8a5642f8","observation_id":"1b5ea51c-2aeb-46b3-8fc0-9a0bee1fe746","resolution":{"observed_at":"2026-08-07T04:53:35.295994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:34.879877Z","title":"Openmmlab pose estimation tool- box and benchmark.https://github.com/open- mmlab/mmpose, 2020","venue":null,"work_id":"4ccf5c88-d3a2-4c8a-a9bd-3731091049f2","year":2020},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.254419Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:9ad97a2b4ff2aedc03f3da358227c581a1614edcad611c168b1889b9a7247780","observation_id":"70a6ce1b-e316-4c7a-9d66-ddae05f0ca0d","resolution":{"observed_at":"2026-08-07T04:53:35.025821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:34.542576Z","title":"Toyota smarthome untrimmed: Real-world untrimmed videos for activity detection.IEEE Transactions on Pattern Analysis and Machine Intelligence, pages 1–1,","venue":null,"work_id":"82b03c38-b0eb-4f0b-93f6-4456a9eb4677","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.375150Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:44e4e0685e3f491379b33425c8cbce425db14280775172fa9ceec17d4f7375bb","observation_id":"aeb5ba77-67ed-499a-ab1a-dcfe1662f3a2","resolution":{"observed_at":"2026-08-07T04:53:34.692619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:34.303554Z","title":"Toyota smarthome: Real-world activities of daily living","venue":null,"work_id":"d34776a2-9457-4d83-b453-2dc8ab66a9fa","year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.479221Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:9389f66b3f24cfa2215d74c3007ecd72dd040dc166978f72ecbec99312e1d643","observation_id":"7d2b98d2-1fbd-48e5-b470-1d3cb8ff925d","resolution":{"observed_at":"2026-08-07T04:53:34.393125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02464","last_updated":"2024-08-05T13:44:22Z","snapshot_observed_at":"2026-07-06T18:56:57.369673Z","submitted_at":"2024-08-05T13:44:22Z","title":"Fairness and Bias Mitigation in Computer Vision: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02464","snapshot_observed_at":"2026-08-07T04:53:16.573935Z","title":"Fairness and bias mitigation in com- puter vision: A survey.arXiv preprint arXiv:2408.02464,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.573935Z"},"links":{"cited_paper":"/paper/2408.02464","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:71be3efe18c7d2bf4bf3dfb2853546d5a7586f2603a2897c46cf5f6cb69360e8","observation_id":"184c7d52-8770-4906-ac61-42454dfd0c53","resolution":{"observed_at":"2026-08-07T04:53:16.573935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T04:53:16.691812Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.691812Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:b59b4c59b4b77c95188d0c2c437cf8c0f1421d14c4765a5287f275072f19dc38","observation_id":"b6c896d5-741d-4526-9906-866151c7f00e","resolution":{"observed_at":"2026-08-07T04:53:16.691812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:33.972897Z","title":"A survey on bias in visual datasets.Computer Vision and Image Understanding, 223: 103552, 2022","venue":null,"work_id":"3d72f1c4-482c-4e1e-bc95-9213488cdeb6","year":2022},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.792904Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:d324ea6d4d7bb1a36e5ba8c88dc39026b38432596eea2acf1c1b8c59ab3629a6","observation_id":"dfa3d527-e99c-4c9a-ad61-47004e4c261a","resolution":{"observed_at":"2026-08-07T04:53:34.152460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:33.782507Z","title":"Pytorchvideo: A deep learning li- brary for video understanding","venue":null,"work_id":"bf354c97-7d74-4b76-a8b9-4cbd16a7e5d8","year":2021},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.896160Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:d721d3e7637251bddb6a68292e6a411a2ae7644a6ca164d46538f0da6e6455b5","observation_id":"c322d559-27c0-4122-ab87-8c8913307b39","resolution":{"observed_at":"2026-08-07T04:53:33.873916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:33.553725Z","title":"Slowfast networks for video recognition","venue":null,"work_id":"8d88641e-30c2-40ab-ae41-5c6afb3ea3b6","year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.049426Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:2b75617c5409d94705dc70ae0189be4e3c6314666819b3a273012e5e5012c40d","observation_id":"1ef0a07f-9463-4705-b21c-e25ad6870c1d","resolution":{"observed_at":"2026-08-07T04:53:33.664025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:33.192659Z","title":"Black, and Timo Bolkart","venue":null,"work_id":"898a94a1-7e49-401c-b96a-ab07a6d1de78","year":2021},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.150341Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:e9b34bf642feb0334e1999957ef18cc9d44ee2dcebb6a99dbef416721caddc81","observation_id":"f7f89402-51d8-4820-bb6e-15ee64a48e99","resolution":{"observed_at":"2026-08-07T04:53:33.359145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:32.955174Z","title":"The” something something” video database for learning and evaluating visual common sense","venue":null,"work_id":"9b5de5ca-81d2-49af-832c-0bc17a3f9a76","year":2017},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.312149Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:9503a5ddea192c062df0f2d1ba01c03ae03986d1e509fcf32a1f62b880229a92","observation_id":"e4159258-e25b-45c5-a6b6-02c24dea5733","resolution":{"observed_at":"2026-08-07T04:53:33.038434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:32.665639Z","title":"DensePose: Dense human pose estimation in the wild","venue":null,"work_id":"f06ce9f7-a6d0-46ce-89ee-caf40241073b","year":2018},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.404717Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:2cbd10e25ce9e36a381ffc48e74454c5c63c96aa233334f73c42b34fbd5a329a","observation_id":"8e603b0f-6e3f-4579-94d7-29e1a7c84c43","resolution":{"observed_at":"2026-08-07T04:53:32.839451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:32.470528Z","title":"Can spatiotemporal 3d cnns retrace the history of 2d cnns and im- agenet? InProceedings of the IEEE conference on Computer Vision and Pattern Recognition, pages 6546–6555, 2018","venue":null,"work_id":"378c957b-4187-4e73-af8e-5419595f2bc1","year":2018},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.515538Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:df3a91a3b289494ec8d04e024a8faad62f5b3cbaadac8e524605c66c8ddede6b","observation_id":"636a41a9-c26b-464f-9a9b-30f88950b9dd","resolution":{"observed_at":"2026-08-07T04:53:32.574049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:17.625297Z","title":"Animate anyone: Consistent and controllable image- to-video synthesis for character animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.625297Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:5510569e56302f08d3f7b17b79d12de3d9074d48b92c0fd8031f71435a41234a","observation_id":"d241e6ae-e20b-4c63-9c89-1c1b875db6b3","resolution":{"observed_at":"2026-08-07T04:53:17.625297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:32.255633Z","title":"Eldersim: A synthetic data generation platform for human action recognition in eldercare applica- tions.IEEE Access, 11:9279–9294, 2021","venue":null,"work_id":"978ade78-b415-4ddd-b04a-fb2918f4fae1","year":2021},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.732553Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:184b292dfab9d672eae96f7823c7b58845e4726e415bd3947b54d629384ab32b","observation_id":"9d001371-1a0e-426c-ab8d-a23a664f43ef","resolution":{"observed_at":"2026-08-07T04:53:32.358645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01830","last_updated":"2023-10-23T08:57:58Z","snapshot_observed_at":"2026-07-06T16:26:58.234941Z","submitted_at":"2023-10-03T06:55:19Z","title":"AI-Generated Images as Data Source: The Dawn of Synthetic Era","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01830","snapshot_observed_at":"2026-08-07T04:53:17.939598Z","title":"Ai-generated images as data sources: The dawn of synthetic era.arXiv preprint arXiv:2310.01830, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.939598Z"},"links":{"cited_paper":"/paper/2310.01830","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:0453a29cabaf52f48ee6fb7c1c3679a94a20cedb30c585db51710aaef6b2fd22","observation_id":"fec7b537-1dfb-4aab-86f1-fe8520f35555","resolution":{"observed_at":"2026-08-07T04:53:17.939598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-07T04:53:18.046555Z","title":"Berg, Wan-Yen Lo, Piotr Doll ´ar, and Ross Girshick","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.046555Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:2b4b21a408c36e1a8d60e26eaf28b161e0f4ce4942f722a5694cce3f9582a881","observation_id":"bcb29a00-d146-4746-b9c1-9a10e5e6336b","resolution":{"observed_at":"2026-08-07T04:53:18.046555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15648","last_updated":"2025-01-26T19:17:05Z","snapshot_observed_at":"2026-07-06T20:26:26.110538Z","submitted_at":"2025-01-26T19:17:05Z","title":"Can Pose Transfer Models Generate Realistic Human Motion?","version":1},"cited_work":{"arxiv_id":"2501.15648","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.15648","snapshot_observed_at":"2026-08-07T04:53:24.477756Z","title":"Can Pose Transfer Models Generate Realistic Human Motion?","venue":"cs.CV","work_id":"71152001-f5e9-4b7c-a3c1-2c86dde494a8","year":2025},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.204562Z"},"links":{"cited_paper":"/paper/2501.15648","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:138a689bef54daf4da5da8bc9118072c0a78f9a4713bc9ff08599b2772acb4f6","observation_id":"7d7b4efc-0f1f-466d-ba98-dad2b5d56c7d","resolution":{"observed_at":"2026-08-07T04:53:24.590306Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:32.030165Z","title":"Hmdb: a large video database for human motion recognition","venue":null,"work_id":"4522a92d-7843-4e90-ba93-9b90d1b1e162","year":2011},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.340268Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:8a860f939182c7ace6fbb8036660379ea7df22726ad147d8348c53ebc1aa33a8","observation_id":"27e27bc3-4988-4a28-ae83-a6129b9cd1ea","resolution":{"observed_at":"2026-08-07T04:53:32.132838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.09849","last_updated":"2020-08-22T14:34:55Z","snapshot_observed_at":"2026-07-06T09:49:19.769284Z","submitted_at":"2020-08-22T14:34:55Z","title":"Data augmentation techniques for the Video Question Answering task","version":1},"cited_work":{"arxiv_id":"2008.09849","doi":null,"metadata_source":"pith","pith_arxiv_id":"2008.09849","snapshot_observed_at":"2026-08-07T04:53:24.183094Z","title":"Data augmentation techniques for the Video Question Answering task","venue":"cs.CV","work_id":"576da932-c280-4997-b574-39386a397792","year":2020},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.448200Z"},"links":{"cited_paper":"/paper/2008.09849","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:cb5b1d34993e4918b04c78a5945f6e6ebf0a35781ad1a547bb3def1737992f98","observation_id":"15879344-bc67-4959-8a19-dba8669c23e1","resolution":{"observed_at":"2026-08-07T04:53:24.311521Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04821","last_updated":"2023-12-05T20:40:59Z","snapshot_observed_at":"2026-07-06T14:28:40.789342Z","submitted_at":"2022-12-08T18:55:31Z","title":"PromptonomyViT: Multi-Task Prompt Learning Improves Video Transformers using Synthetic Scene Data","version":3},"cited_work":{"arxiv_id":"2212.04821","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.04821","snapshot_observed_at":"2026-08-07T04:53:23.925108Z","title":"PromptonomyViT: Multi-Task Prompt Learning Improves Video Transformers using Synthetic Scene Data","venue":"cs.CV","work_id":"d7fbed1e-7cd1-41a9-98fe-03fc5794d103","year":2022},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.646142Z"},"links":{"cited_paper":"/paper/2212.04821","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:a3bfb83dbce8771fa5a4cde8f8568537dac79503c4c4f24b48b93ed170bced3a","observation_id":"07e75cc4-2f59-4594-9793-db5c4da4dbc9","resolution":{"observed_at":"2026-08-07T04:53:24.027766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:31.729688Z","title":"Liquid warping gan: A unified framework for human motion imitation, appearance transfer and novel view syn- thesis","venue":null,"work_id":"0a526347-6653-4816-bffb-36e2172457ee","year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.746986Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:2bf54fb202ba934de390152a8cdab07852fd34036f606fc69a00d5d6d26d3f8d","observation_id":"54910632-6705-469d-a650-2d7b75cb4ba8","resolution":{"observed_at":"2026-08-07T04:53:31.905763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:18.817233Z","title":"Smpl: A skinned multi- person linear model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.817233Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:2b43ca726ceaa47f284481874e1f3e0b21a85f27cfb16a078409d94794e0cf2e","observation_id":"ba58e93e-bd89-4704-9ffb-84ec0229c869","resolution":{"observed_at":"2026-08-07T04:53:18.817233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:31.445270Z","title":"Self-supervised monocu- lar depth estimation on water scenes via specular reflection prior.Digital Signal Processing, 149:104496, 2024","venue":null,"work_id":"e937eef5-0e99-4eb3-9a2c-6446f9faed69","year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.915905Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:d1a42054f2655ea1b81148afb55e9f495159283d92343a0ca5ce5c71c6df823a","observation_id":"aefaa979-2136-419e-8309-0b3db097dd3c","resolution":{"observed_at":"2026-08-07T04:53:31.525194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:31.118354Z","title":"Pose guided person image genera- tion","venue":null,"work_id":"d338b57d-7fc8-4cec-9dee-d428aa5c4670","year":2017},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.955959Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:a1607bc6c22be357dce41d9eca4f2272e5178c3f91a2c91c1c889682d007c717","observation_id":"7d60ec4d-51e9-4ca3-bac8-ac4aa7ca594c","resolution":{"observed_at":"2026-08-07T04:53:31.278330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:30.919894Z","title":"Controllable person image syn- thesis with attribute-decomposed gan","venue":null,"work_id":"c5893657-fc1d-4174-b5bb-909b1ac182c6","year":2020},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.078731Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:114434e58eb65b39c2f55677e6fb3901bd7118026a1a3e4aa4cfc9ef06372cf2","observation_id":"78bfe580-9d30-4ccd-b873-9357de54940f","resolution":{"observed_at":"2026-08-07T04:53:30.986649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:30.693052Z","title":"Ac- curate 3d hand pose estimation for whole-body 3d human mesh estimation, 2022","venue":null,"work_id":"cafb7838-2ac9-48f2-94ac-4ff64a002a8d","year":2022},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.148217Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:57af1044d8112ea245823f8003bfd710138be41bd23acb1c47130b8d29eee966","observation_id":"046186a0-d53c-416c-8651-f39fb8a7c33a","resolution":{"observed_at":"2026-08-07T04:53:30.786519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:30.489525Z","title":"Expressive whole-body 3d gaussian avatar, 2024","venue":null,"work_id":"a0087180-70a7-4a64-bf36-1038993a39cc","year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.256477Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:9db0383882d53b69875bdcd212d120af345656328656988ced3466d9d9c8163b","observation_id":"9f47488c-dbd8-4d4c-8f05-426e73d9089b","resolution":{"observed_at":"2026-08-07T04:53:30.592166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:19.337630Z","title":"Pytorch: An im- perative style, high-performance deep learning library.Ad- vances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.337630Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:83649a9189d1fa8ccc4f28b5ce9e3da2747ce1a4d82622ba8310519866377013","observation_id":"8ed114c7-e014-4b4b-b998-23438c7a81be","resolution":{"observed_at":"2026-08-07T04:53:19.337630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:30.225975Z","title":"Expressive body capture: 3D hands, face, and body from a single image","venue":null,"work_id":"b6c94658-2aed-41fa-b35a-fb6be2616ae6","year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.395716Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:e793d6be9da7759e7794a1f9a02cd757c8adce3d27e983074edaccca54bb090c","observation_id":"e05cacf1-0373-4498-b32e-f5b7e4b6f606","resolution":{"observed_at":"2026-08-07T04:53:30.316906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:29.934519Z","title":null,"venue":null,"work_id":"203f608b-5efc-4a92-aa69-8bd352696b82","year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.466052Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:60e88bcb5666996c3fabd1de23493472ef7014c7d1659d2695b205862af4116b","observation_id":"1ef29b67-bbb0-4b70-8d65-ef941d0afd61","resolution":{"observed_at":"2026-08-07T04:53:30.050318Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03638","last_updated":"2024-11-06T03:30:46Z","snapshot_observed_at":"2026-07-06T19:45:57.808548Z","submitted_at":"2024-11-06T03:30:46Z","title":"Adaptive Stereo Depth Estimation with Multi-Spectral Images Across All Lighting Conditions","version":1},"cited_work":{"arxiv_id":"2411.03638","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.03638","snapshot_observed_at":"2026-08-07T04:53:23.721623Z","title":"Adaptive Stereo Depth Estimation with Multi-Spectral Images Across All Lighting Conditions","venue":"cs.CV","work_id":"fbefc2c7-a9a6-4af1-aeaf-c10e210b0c3c","year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.573630Z"},"links":{"cited_paper":"/paper/2411.03638","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:de403685bf8b60fe070cb558a86b9d6f08b29d6d13c4036a3a5a6e447c28971c","observation_id":"c9a13d72-09dd-43fd-967b-ae148bd5f7f7","resolution":{"observed_at":"2026-08-07T04:53:23.809914Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:29.748879Z","title":"Synthetic-to-real domain adaptation for action recognition: A dataset and baseline performances","venue":null,"work_id":"64558e72-bafb-4150-8a11-22e791c3f3f0","year":2023},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.631319Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:eabd33d4ca04c1eed7dfeabcb29f93466becdcda2dcff8644358561da54df3d2","observation_id":"e86a0b66-7cf9-4a9f-b83a-47ca8b7ef8d4","resolution":{"observed_at":"2026-08-07T04:53:29.848743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.06777","last_updated":"2025-02-18T17:18:45Z","snapshot_observed_at":"2026-07-06T12:37:32.486119Z","submitted_at":"2022-02-14T14:58:05Z","title":"Multi-scale Attention Guided Pose Transfer","version":2},"cited_work":{"arxiv_id":"2202.06777","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.06777","snapshot_observed_at":"2026-08-07T04:53:23.441036Z","title":"Multi-scale Attention Guided Pose Transfer","venue":"cs.CV","work_id":"dce57ade-34b3-48af-9bc8-f7be432af49c","year":2022},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.687703Z"},"links":{"cited_paper":"/paper/2202.06777","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:d1016f3415e12bbb0ebd100e2501e494a4e95d18f96c5b547cfb249534e6abfd","observation_id":"b51cadf3-695a-4b66-95ba-c7a2552067a8","resolution":{"observed_at":"2026-08-07T04:53:23.581496Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:29.599563Z","title":"Doubletake: Geometry guided depth estimation","venue":null,"work_id":"d963348c-b9a3-4443-94b7-fa7845d45638","year":2025},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.756133Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:c6e9e8eadeefbeaf311d1f9bcfefb5a13973abf80fb03fdcc298771b68bd2cd6","observation_id":"28100d6a-8b91-4117-8a92-0a46ec6334d6","resolution":{"observed_at":"2026-08-07T04:53:29.656968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:29.400596Z","title":"SynthAct: Towards generalizable human action recognition based on synthetic data","venue":null,"work_id":"0afe2344-b78b-48f5-8187-94d871056642","year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.830166Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:47a3123769ec7d6563cd2e6a4d3f1e6051fbda40351175759ac49c83f8b2c43a","observation_id":"5ad2142d-8307-4f46-b005-4872e1983950","resolution":{"observed_at":"2026-08-07T04:53:29.508871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:29.160151Z","title":"NTU RGB+D: A large scale dataset for 3d human activity analysis","venue":null,"work_id":"e410ef8a-9ad3-4f6f-8a90-1c3f49e184d0","year":2016},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.917590Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:0f146d738a54628c8bd8f0bbd2a0d5a42272985e145f61ee7d08f7cc33cb7aa1","observation_id":"2095d12e-8f26-4083-9e18-f583f0b007a0","resolution":{"observed_at":"2026-08-07T04:53:29.300629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:28.907418Z","title":"Deformable gans for pose-based human image generation","venue":null,"work_id":"a3e2d73b-16b9-4fce-a6bd-db3446634be2","year":2018},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.976457Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:7b979e5db85564ae793764b03bdfff8b5ba7fb684bd610ac4a85a8eeb2b06ebe","observation_id":"0758f38e-3230-4db3-834f-434f7be656bc","resolution":{"observed_at":"2026-08-07T04:53:29.041994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-07T04:53:20.041116Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild.ArXiv, abs/1212.0402, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.041116Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:7342aa084c0b0bb5ac3db4babcb9a9e21e2ca6c3058cf00612bb83b43536b5d8","observation_id":"14d94331-b24e-4d80-9300-f96fd3ef221e","resolution":{"observed_at":"2026-08-07T04:53:20.041116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:28.639936Z","title":"Synthetic data generation: A hands-on guide in python, 2024","venue":null,"work_id":"f60d1b4c-8996-4cb3-b15a-c45fcadc3c0b","year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.130741Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:b5cefb6368da5b03f2c0d6b10bf88289b237e513cf27efffa8d51bb26935c354","observation_id":"ad96a035-0523-4bc7-8fe2-f9e29e92a5d5","resolution":{"observed_at":"2026-08-07T04:53:28.783131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:28.377596Z","title":"Videomae: Masked autoencoders are data-efficient learners for self-supervised video pre-training.Advances in neural information processing systems, 35:10078–10093, 2022","venue":null,"work_id":"3d61b026-e5e1-4bf3-836a-53946121a061","year":2022},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.186832Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:ae56e7c2efefef592ea0948002099acdd94368c3de64146b10063366fa00576d","observation_id":"193274ff-4b36-4a66-a185-8ba1e7ce9f3c","resolution":{"observed_at":"2026-08-07T04:53:28.544041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:28.141146Z","title":"Synthetic humans for action recognition from un- seen viewpoints.International Journal of Computer Vision, 129(7):2264–2287, 2021","venue":null,"work_id":"dd57efbd-c086-4c56-839e-ea21127e554f","year":2021},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.270777Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:eecc7bfefed685a8512b0ab64e3b086ae8398651eb5609f262f6caec08eac9d2","observation_id":"6cb50a43-0b14-4195-bafe-47c37f123ff2","resolution":{"observed_at":"2026-08-07T04:53:28.229294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00856","last_updated":"2021-11-02T03:02:33Z","snapshot_observed_at":"2026-07-06T12:04:06.076820Z","submitted_at":"2021-11-01T11:53:30Z","title":"Large-Scale Deep Learning Optimizations: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00856","snapshot_observed_at":"2026-08-07T04:53:20.356697Z","title":"Large-scale deep learning optimizations: A comprehensive survey.arXiv preprint arXiv:2111.00856, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.356697Z"},"links":{"cited_paper":"/paper/2111.00856","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:27b23266f8836c88b4e3c51fc5ac5032bb9961762bafc781774a202765e93c6b","observation_id":"a8705629-a2db-4191-ad28-ac4d97e1c1f4","resolution":{"observed_at":"2026-08-07T04:53:20.356697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04190","last_updated":"2024-03-07T03:38:44Z","snapshot_observed_at":"2026-07-06T17:40:45.750926Z","submitted_at":"2024-03-07T03:38:44Z","title":"Generative AI for Synthetic Data Generation: Methods, Challenges and the Future","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04190","snapshot_observed_at":"2026-08-07T04:53:20.493931Z","title":"Generative ai for synthetic data generation: Methods and applications.arXiv preprint arXiv:2403.04190, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.493931Z"},"links":{"cited_paper":"/paper/2403.04190","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:04b2ccc0abf4b365fc2fe4d52a32ac9c989289e6c4443cc4e2cf9ec66fbdbfde","observation_id":"45262b81-68c7-4611-8a16-e524194a2c66","resolution":{"observed_at":"2026-08-07T04:53:20.493931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:20.648897Z","title":"Magicanimate: Temporally consistent human im- age animation using diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.648897Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:a5c43c995e8dc21f20b624bf13d9fd130413213f6548e9a8f625a54d50ced8a6","observation_id":"3870d04a-68e8-46e0-ac5e-00e2aa4d4399","resolution":{"observed_at":"2026-08-07T04:53:20.648897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:20.811889Z","title":"Depth any- thing v2, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.811889Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:c60e3979a22efda5925c13ba8c353086d44a46fd5986ba5c4189d8505e49bc3f","observation_id":"e39afa0a-7660-4c63-92c5-ab34c279277d","resolution":{"observed_at":"2026-08-07T04:53:20.811889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04790","last_updated":"2022-07-24T01:15:03Z","snapshot_observed_at":"2026-07-06T13:19:19.391885Z","submitted_at":"2022-06-09T23:04:52Z","title":"Learn2Augment: Learning to Composite Videos for Data Augmentation in Action Recognition","version":2},"cited_work":{"arxiv_id":"2206.04790","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.04790","snapshot_observed_at":"2026-08-07T04:53:23.091694Z","title":"Learn2Augment: Learning to Composite Videos for Data Augmentation in Action Recognition","venue":"cs.CV","work_id":"7fa848be-38f6-455b-8e98-290fe72ea8e0","year":2022},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.939523Z"},"links":{"cited_paper":"/paper/2206.04790","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:ae756ecfaa188ae4d2cc6bf2597e2023eb51f7ecff6b2483b384f0b065d20c2a","observation_id":"215fa646-1a50-4156-97aa-3ee59bcf0e08","resolution":{"observed_at":"2026-08-07T04:53:23.229798Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:27.905640Z","title":"Progressive pose attention transfer for person image generation","venue":null,"work_id":"debda128-33e4-48ca-948f-313c204ae220","year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.048316Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:c5d3b45f4e8403c6f4cc81f71ca4fc620d65dc83f551f9c976bc9aa5c0bf8a92","observation_id":"6e251478-ce5e-4a1f-8305-bd49dc4516e6","resolution":{"observed_at":"2026-08-07T04:53:27.997647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14781","last_updated":"2024-06-01T08:27:23Z","snapshot_observed_at":"2026-07-06T17:48:41.389936Z","submitted_at":"2024-03-21T18:52:58Z","title":"Champ: Controllable and Consistent Human Image Animation with 3D Parametric Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14781","snapshot_observed_at":"2026-08-07T04:53:21.171337Z","title":"Champ: Controllable and consistent human image animation with 3d parametric guidance.arXiv preprint arXiv:2403.14781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.171337Z"},"links":{"cited_paper":"/paper/2403.14781","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:10603c8f34aa32306ab4de36a3147ecff237f929d150d6f45fe0a5171abe7d55","observation_id":"123f2de6-399d-4c99-bfb3-5d8cdd6ef1d9","resolution":{"observed_at":"2026-08-07T04:53:21.171337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:27.695795Z","title":null,"venue":null,"work_id":"56d9c1a2-771d-448a-b0ed-f5c734ba8b60","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.275316Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:58768f12c1bfc1d980dfd6ae0500413e256713e54a26b65594a0753c7feb59ba","observation_id":"6677ac3c-5b66-4f47-ac24-e55ef1f7745d","resolution":{"observed_at":"2026-08-07T04:53:27.779717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:27.382013Z","title":null,"venue":null,"work_id":"98738d9f-ab8d-4439-a6ab-e7b05bf16a14","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.432906Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:9ed5243227ca21af4c507d31c7c6dcb7f4749fb3c6e4a31b25769da8e8183d61","observation_id":"a8958da4-29ac-4563-942b-ef591607fcb7","resolution":{"observed_at":"2026-08-07T04:53:27.531378Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:27.166848Z","title":null,"venue":null,"work_id":"dc5384b1-7960-4076-8297-fa450beae2b9","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.539037Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:2cc447842e7b07927953b8ac3d4c3d328be56f1ae560969af72aaf6345827294","observation_id":"944ac551-9b3e-4a43-8433-8460184f2f39","resolution":{"observed_at":"2026-08-07T04:53:27.282635Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:26.916108Z","title":"Importantly, the recording must meet the follow- ingcriteria: • Your whole body, head to feet, is visible in the video at all times","venue":null,"work_id":"d0f55d14-7fc7-4233-834d-f5cab07d0929","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.643159Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:878568d5a1915d380e032912461a89c33f2229fdcfaa50660a5467534fe79d8e","observation_id":"a8105aa9-b3fb-4215-a401-dbef9c660515","resolution":{"observed_at":"2026-08-07T04:53:27.030409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:26.662340Z","title":"In particular, these subsets in- clude: Selected Action Classes: Toyota Smarthome","venue":null,"work_id":"076c95bd-424b-49a7-ae51-fe74e03eff2b","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.796496Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:856f68033ffd048d88731a6b85f5721493b18c080b0dbea8b00cf56509382866","observation_id":"9bff57fc-ec94-4527-bfe4-0a067d98a501","resolution":{"observed_at":"2026-08-07T04:53:26.779442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:26.387107Z","title":null,"venue":null,"work_id":"fdf074cc-af88-4c6c-919d-c546afb9c346","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.918315Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:61dd274732d9b7df5d40621f98d4ee6fd28608bf682ee28f977c0bc03136d02d","observation_id":"ae284ced-9fb8-45c5-963b-e65dd3589e0a","resolution":{"observed_at":"2026-08-07T04:53:26.519540Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:26.194439Z","title":null,"venue":null,"work_id":"023d24a2-71da-4041-842d-6c028c6c0b1f","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:22.049438Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:bd8628ae0212bab0d0ae5fcb3b90ea69b263a331122e388cb168ce99a75c5638","observation_id":"11340308-bfd3-42af-85bc-6c851d87b354","resolution":{"observed_at":"2026-08-07T04:53:26.281589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:25.986447Z","title":null,"venue":null,"work_id":"74dd4acf-73b2-419b-a7b3-93d9247c99b7","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:22.212634Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:811fff73c51f8ef31c2ae5a0a50c8ca0efba34e6b9d3ed1048b7ca0602f94f48","observation_id":"f353f64c-7b12-449e-ba51-856fae8df7ea","resolution":{"observed_at":"2026-08-07T04:53:26.097712Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:25.770733Z","title":null,"venue":null,"work_id":"bbfd6421-fb67-458d-9fe5-9b651fb5d78c","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:22.370248Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:e03652c28a6a8eb18571023e1c2364da6df589e3abdc1a362d4d848d17cafb96","observation_id":"62671c16-0585-4093-ad01-bdcb38142d46","resolution":{"observed_at":"2026-08-07T04:53:25.861320Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:25.498687Z","title":null,"venue":null,"work_id":"7df84460-7eac-4d54-a74f-324efc9da05f","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:22.492572Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:ed96ca85f29c03b109a136198f755e34035d600465440aaf3f3acee6d6038b6b","observation_id":"bf136aca-2dd4-472b-9d42-b58421f53fe4","resolution":{"observed_at":"2026-08-07T04:53:25.628156Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:25.286467Z","title":null,"venue":null,"work_id":"a99deddb-4d20-48e1-901d-289ee82f1b49","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:22.662726Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:9714b9433ab39dcf3b04cf9a56d94e1aef9706ac4faf97361582f1ce705ad634","observation_id":"5d39157b-e0dc-40de-802e-cdf641c64c96","resolution":{"observed_at":"2026-08-07T04:53:25.400568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:25.007632Z","title":"Our aim is to provide an intuition for the computational demands of this process and to explain the parameters we chose, which were largely constrained by our computing capacity","venue":null,"work_id":"ab3d7eb4-468b-4445-9b36-bb164cf6323c","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:22.775561Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:1f3b411fe5a575c56c712990c1ddad2e9aeb2c8e343a50172515184ef6a89186","observation_id":"ce778140-3aea-4b17-b346-c48668d372e8","resolution":{"observed_at":"2026-08-07T04:53:25.141005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:24.781985Z","title":null,"venue":null,"work_id":"dbee1dbe-f05f-477d-bca2-526591888336","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:22.927707Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:e51716078372709b37d142cb2f90786c4c1d208ce8e240ee56419c870869a562","observation_id":"a1f2e982-32b3-4275-8431-323d1a1a1c66","resolution":{"observed_at":"2026-08-07T04:53:24.871891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T04:46:29.967110Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":4,"unresolved":22,"verified_exact":6,"verified_fuzzy":34},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2506.09411."}