{"as_of":"2026-08-18T11:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:60c9f4cde99f9b4fb555364d733c361c19b6b2cbf37ee8b8707fab271aeefda6","coverage":[{"denominator":89,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":89,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:19:04.644531Z","state":"measured"},{"denominator":89,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":89,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.13437/citation-record","integrity":"/paper/2505.13437/integrity","json":"/paper/2505.13437/citation-record.json","paper":"/paper/2505.13437"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T20:19:03.376373Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.376373Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:4050e51e077836c282bdd83b3154715073c6c91cfa5d58765893e7a21f66b0ab","observation_id":"cbcfebbd-d26b-478e-ab64-a4e6181f0e6a","resolution":{"observed_at":"2026-08-15T20:19:03.376373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08477","last_updated":"2023-04-18T03:27:52Z","snapshot_observed_at":"2026-08-16T15:39:48.920549Z","submitted_at":"2023-04-17T17:57:06Z","title":"Latent-Shift: Latent Diffusion with Temporal Shift for Efficient Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08477","snapshot_observed_at":"2026-08-15T20:19:03.382312Z","title":"Latent-shift: Latent diffu- sion with temporal shift for efficient text-to-video genera- tion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.382312Z"},"links":{"cited_paper":"/paper/2304.08477","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:cc816f9f8dc589a2daf419b27bce59bfc8f4efe6b1a78f6d6d0f21061fa7e100","observation_id":"99329033-45e6-46a9-9815-da67e797db1b","resolution":{"observed_at":"2026-08-15T20:19:03.382312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.387164Z","title":"Learned neural physics sim- ulation for articulated 3d human pose reconstruction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.387164Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:b0579d79bbbc346e826c58bbe41b2b305ab8a2890b89c9e2fa9d425bfc4380bb","observation_id":"c4dab857-dd62-41a7-aa1b-bcf60d7bdafe","resolution":{"observed_at":"2026-08-15T20:19:03.387164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18035","last_updated":"2024-05-13T01:06:58Z","snapshot_observed_at":"2026-08-16T15:28:42.702582Z","submitted_at":"2023-05-29T11:55:11Z","title":"Physics-Informed Computer Vision: A Review and Perspectives","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18035","snapshot_observed_at":"2026-08-15T20:19:03.392339Z","title":"Physics-informed computer vision: A review and perspectives","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.392339Z"},"links":{"cited_paper":"/paper/2305.18035","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:9196c9d3da7954bd6eff7cce6b491ae0eb38d3a8cfdf63811c8eadddfe64d53d","observation_id":"c84d0f65-c65a-4056-bb96-d3edbd13c005","resolution":{"observed_at":"2026-08-15T20:19:03.392339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.397929Z","title":"Physics-informed computer vision: A re- view and perspectives","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.397929Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:d2a6db5da6a98cbbc60a941582388fec5d2ffdd847ea9645a797a7be837a493f","observation_id":"2eb97621-640e-446e-a33a-a49341a662df","resolution":{"observed_at":"2026-08-15T20:19:03.397929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.402581Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.402581Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:fd465e58b3f5af300bd3de27f037a48942f6c56ab83eac9ee9929195dadd73d7","observation_id":"4ce9cfb6-dd32-4914-ba20-cd8597cbc1f6","resolution":{"observed_at":"2026-08-15T20:19:03.402581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-13T01:39:12.659510Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-15T20:19:03.408117Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.408117Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:d6be091defaaa7e20df0f7ba0253b052cd095ed707df7da7cbb61223f504d517","observation_id":"308f0269-3245-4be2-9374-95519678d1cf","resolution":{"observed_at":"2026-08-15T20:19:03.408117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.413166Z","title":"Finecliper: Multi-modal fine-grained clip for dynamic facial expression recognition with adapters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.413166Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:e39a0503a10516d7d53ad61ba34cfd1240496dcce6cef63ccb50ca23d469a1d6","observation_id":"44a6580e-5a7c-4514-8127-71d460e35c18","resolution":{"observed_at":"2026-08-15T20:19:03.413166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07472","last_updated":"2024-05-23T07:54:48Z","snapshot_observed_at":"2026-08-16T13:53:18.586373Z","submitted_at":"2024-05-13T05:18:07Z","title":"GaussianVTON: 3D Human Virtual Try-ON via Multi-Stage Gaussian Splatting Editing with Image Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07472","snapshot_observed_at":"2026-08-15T20:19:03.417080Z","title":"Gaussianvton: 3d human virtual try- on via multi-stage gaussian splatting editing with image prompting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.417080Z"},"links":{"cited_paper":"/paper/2405.07472","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:211d8269ceef5df6dcb36c70b056bb14e4917118e0edf1534a95990614165e6d","observation_id":"bce994bf-1c8a-4e89-8614-64df2bf3977a","resolution":{"observed_at":"2026-08-15T20:19:03.417080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02114","last_updated":"2025-03-18T10:51:59Z","snapshot_observed_at":"2026-08-15T18:30:03.841893Z","submitted_at":"2024-12-03T03:10:19Z","title":"Beyond Generation: Unlocking Universal Editing via Self-Supervised Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02114","snapshot_observed_at":"2026-08-15T20:19:03.421561Z","title":"Omnicreator: Self-supervised unified generation with uni- versal editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.421561Z"},"links":{"cited_paper":"/paper/2412.02114","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:f4491fb68710f57ff86a39a6810496cabfed2c98384dc4978568ce7e7d41dabe","observation_id":"eaca3b41-4ed7-44b1-9c93-2e0052ded92a","resolution":{"observed_at":"2026-08-15T20:19:03.421561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.426866Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffu- sion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.426866Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:a255f19900beda81369e1f08cd33635cf6489433913b570f6ec49c4491092684","observation_id":"63c29b01-065a-408b-a51b-583a7087ff90","resolution":{"observed_at":"2026-08-15T20:19:03.426866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15417","last_updated":"2025-03-19T16:59:32Z","snapshot_observed_at":"2026-08-16T12:48:31.918752Z","submitted_at":"2025-03-19T16:59:32Z","title":"Temporal Regularization Makes Your Video Generator Stronger","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15417","snapshot_observed_at":"2026-08-15T20:19:03.432162Z","title":"Temporal regularization makes your video generator stronger","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.432162Z"},"links":{"cited_paper":"/paper/2503.15417","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:70ef2c7c767bfbd73c087d56d7a3b8a1bba3fb8a1dcbe2504a572b2cddeedd3e","observation_id":"872e5eec-b0c9-4ae8-b76c-4334604e7d03","resolution":{"observed_at":"2026-08-15T20:19:03.432162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-08-16T15:30:44.303194Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-15T20:19:03.437136Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.437136Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:baee90083fb456cb04bf9249d3beaae6198b9fca8e9028259583971a46bbb499","observation_id":"17c54c64-b322-4337-b691-57680530a09e","resolution":{"observed_at":"2026-08-15T20:19:03.437136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.441230Z","title":"Disentangling structured components: Towards adaptive, interpretable and scalable time series forecasting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.441230Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:2b814d489852b4de3a8c09ceb8d8bc2a2c94e39a86f5a722663fb47265217e5b","observation_id":"1be47755-694b-4b9c-b680-2fadec56fba3","resolution":{"observed_at":"2026-08-15T20:19:03.441230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.445236Z","title":"Parsimony or capability? decomposition delivers both in long-term time series forecasting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.445236Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:6de46d4fcb4355277a626dde3c5044d2aa17a293c0272b68eec4e4293d775403","observation_id":"928009a1-b34b-4b22-b89f-75d6838dc20f","resolution":{"observed_at":"2026-08-15T20:19:03.445236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.450150Z","title":"Revisiting skeleton-based action recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.450150Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:095702b511a9879cdbdc71ec1b64537c63cfb661cfa4092a51a6b5948ea089e6","observation_id":"e8abd454-8639-4f62-ac01-6d1de74f8a48","resolution":{"observed_at":"2026-08-15T20:19:03.450150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.454941Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.454941Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:e94e356440b0080fda248a2f400813a9ed1ccda7b044e5b5231260dbc26c226f","observation_id":"3bb21376-7ed9-43c4-904e-6afd11fbf969","resolution":{"observed_at":"2026-08-15T20:19:03.454941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.459675Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.459675Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:f1680bb53c2411fd02201738bdd6c1cd98d3edec2e0a1822775e0ddbeb46de34","observation_id":"67767792-0f9b-4f27-9351-fd8d952319f4","resolution":{"observed_at":"2026-08-15T20:19:03.459675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:07.190379Z","title":"Hu- manrefiner: Benchmarking abnormal human generation and refining with coarse-to-fine pose-reversible guidance","venue":null,"work_id":"dfdc87a0-7fc9-44fe-9ff1-b7a1734ba01f","year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.465170Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:02d7eaa79cd4f296308cebe7d17edb3374b7237bef71ea7322a4451fb32c134c","observation_id":"16f1f00d-02ef-43f9-8934-ba8ecc4b24e3","resolution":{"observed_at":"2026-08-15T20:19:07.211798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-15T20:19:03.471039Z","title":"An image is worth one word: Personalizing text-to- image generation using textual inversion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.471039Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:9e456706d2725e708f5c72edef3914ac6950c5bc04bcb2f407095cfc0f879019","observation_id":"db961e17-3581-4dc6-93e3-51b77034b358","resolution":{"observed_at":"2026-08-15T20:19:03.471039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:07.171101Z","title":"Differentiable dynamics for articu- lated 3d human motion reconstruction","venue":null,"work_id":"b9c68892-c536-4611-9436-6b0710b376e8","year":2022},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.476107Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:6dd7a4bb8524feb4130d6915c24f03c7469fcc2cbde009da788012598c64c3bd","observation_id":"a5adcd4d-447d-4127-a1c0-87671511ff74","resolution":{"observed_at":"2026-08-15T20:19:07.175281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:07.158712Z","title":"Trajectory optimization for physics-based re- construction of 3d human pose from monocular video","venue":null,"work_id":"85c07970-b42f-4c1e-9364-e91ad8cbccda","year":2022},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.480821Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:d6bc21a973acac7d44d1abe2e040b7226a6e4f0525008970da9461b2f611deb9","observation_id":"bcb8102e-c870-434a-be81-27e3c5c4397d","resolution":{"observed_at":"2026-08-15T20:19:07.162937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-17T14:04:31.230742Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-15T20:19:03.486522Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.486522Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:3543f093712b788a36d8a6ed931a8741ff429b441eaa145c3524fe4d42af54df","observation_id":"1765c4f4-1def-425d-99b9-137492766901","resolution":{"observed_at":"2026-08-15T20:19:03.486522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.491187Z","title":"Sparsectrl: Adding sparse controls to text-to-video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.491187Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:18bfb79816823db06b1f09bd51cb95cc3424a0df3afeab167dac17515dcab9a9","observation_id":"d40b61d8-f389-4787-98f7-fc081b084623","resolution":{"observed_at":"2026-08-15T20:19:03.491187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:07.141002Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"da186aa6-58d0-499e-88b6-9d2efb928c91","year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.495798Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:02dfa7cf73eff1f9aa2af02212c9069aa55904d6019a4dfaa6e8796b575d7409","observation_id":"95ddcf10-ced9-4c34-86d8-3e97e22b6e8f","resolution":{"observed_at":"2026-08-15T20:19:07.144649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06940","last_updated":"2023-07-13T17:57:13Z","snapshot_observed_at":"2026-08-17T09:14:04.566795Z","submitted_at":"2023-07-13T17:57:13Z","title":"Animate-A-Story: Storytelling with Retrieval-Augmented Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06940","snapshot_observed_at":"2026-08-15T20:19:03.500621Z","title":"Animate-a-story: Storytelling with retrieval-augmented video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.500621Z"},"links":{"cited_paper":"/paper/2307.06940","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:4619dde7c26bbeddd5c736e42891440d3a96c78cb2017a5c478d84ec1f5fb80a","observation_id":"a6f37868-d7d9-4486-9a3a-c83be0f455eb","resolution":{"observed_at":"2026-08-15T20:19:03.500621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.506148Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.506148Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:fb9980f44a60b0da64389e7610d6f16b5691196dac4134a0b10b9f89de3fdf04","observation_id":"ee07d71b-b699-49ad-bc0c-1746c5780e52","resolution":{"observed_at":"2026-08-15T20:19:03.506148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.512124Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen- Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.512124Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:7a616c5b91b842f29d25d27598869d78e61a78d66affb1a62c3ff4edf252e22c","observation_id":"4dab98b5-b5d7-4283-a34f-739afa555a3b","resolution":{"observed_at":"2026-08-15T20:19:03.512124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:07.116040Z","title":"Neural mocon: Neural motion control for phys- ically plausible human motion capture","venue":null,"work_id":"ce57187c-c5a5-4da5-ae28-b0de3a258069","year":2022},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.518202Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:f3ea40634f6032bbfdb378b7e711dead07388612b25b8a671ce9aed545834f7d","observation_id":"91ed2c61-fefd-470e-ad91-64a9373c1568","resolution":{"observed_at":"2026-08-15T20:19:07.120026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13122","last_updated":"2025-04-17T17:39:41Z","snapshot_observed_at":"2026-08-17T12:45:16.433408Z","submitted_at":"2025-04-17T17:39:41Z","title":"VistaDPO: Video Hierarchical Spatial-Temporal Direct Preference Optimization for Large Video Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13122","snapshot_observed_at":"2026-08-15T20:19:03.525559Z","title":"Vistadpo: Video hierarchical spatial-temporal direct prefer- ence optimization for large video models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.525559Z"},"links":{"cited_paper":"/paper/2504.13122","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:c74a87a98e87e3338aa36731058a2bee6327e707bfb2a5e389f219f45f98cdc3","observation_id":"862f5644-7c48-4c7b-a1d9-9ceb880ba262","resolution":{"observed_at":"2026-08-15T20:19:03.525559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01245","last_updated":"2025-01-02T13:12:12Z","snapshot_observed_at":"2026-08-16T06:54:33.623506Z","submitted_at":"2025-01-02T13:12:12Z","title":"SeFAR: Semi-supervised Fine-grained Action Recognition with Temporal Perturbation and Learning Stabilization","version":1},"cited_work":{"arxiv_id":"2501.01245","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.01245","snapshot_observed_at":"2026-08-15T20:19:04.762757Z","title":"SeFAR: Semi-supervised Fine-grained Action Recognition with Temporal Perturbation and Learning Stabilization","venue":"cs.CV","work_id":"7affd5ac-c8f3-4fc6-9cd0-5e7e4d0147ec","year":2025},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.529663Z"},"links":{"cited_paper":"/paper/2501.01245","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:6dd1280174fa86abdb9a0c140a15850ecf8e55b31bf1e0730808b8cd2b32f7e2","observation_id":"30c29b88-d4f5-4fca-9cf8-92cdf6eb58ca","resolution":{"observed_at":"2026-08-15T20:19:04.855458Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:07.105244Z","title":null,"venue":null,"work_id":"f97e927e-08ac-4048-82c6-ed4f7c4e121e","year":2013},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.534957Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:eb67137472ca9fac6ac49d2348140fa0de4c304b9ab5f2e02b657e60e9795896","observation_id":"def352ad-8a6e-4c2e-99ec-54a03e0ebb61","resolution":{"observed_at":"2026-08-15T20:19:07.109113Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:07.093401Z","title":"Humansd: A native skeleton-guided diffusion model for human image generation","venue":null,"work_id":"48ca7c60-5e30-4f3d-bb79-592c2fb5209b","year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.538572Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:963e5b4980a811fe2b70ab11512d19781437d9ce1795addeee101d31cfc60a40","observation_id":"15fef37c-9058-4d80-b972-452424eda32b","resolution":{"observed_at":"2026-08-15T20:19:07.097051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:07.039550Z","title":"Generalization in diffusion models arises from geometry-adaptive harmonic representations","venue":null,"work_id":"a5810f3d-07c3-4d6b-881b-28b1da744da7","year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.543041Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:be4872b012e499790de84cb8054a888c15ef6d6bf39b8d754d76f345166427bb","observation_id":"9de2751c-26ad-4d3f-8580-4c6a90ab0a7d","resolution":{"observed_at":"2026-08-15T20:19:07.066945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.997850Z","title":"Pix2gif: Motion-guided diffusion for gif generation","venue":null,"work_id":"0d7a67f7-f287-4ac6-94a9-a6d78edfc273","year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.547323Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:f982f09169617424a0168eac25c3e5e4a3f5ea44a527f18900a43fd5f4b1fcf7","observation_id":"f31205b9-826d-464e-b216-4bf1e51164ac","resolution":{"observed_at":"2026-08-15T20:19:07.002602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.986057Z","title":"How far is video generation from world model: A physical law perspective,","venue":null,"work_id":"dfe94711-6e71-4d48-9a03-67625d3662e1","year":null},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.552287Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:b145cb3f2b6e8bac797f599c18b2cc800d11c3cbf62ed17ff50e4dbc0b0628bf","observation_id":"cfd42263-41fe-45bc-b4c8-47a758bb6c51","resolution":{"observed_at":"2026-08-15T20:19:06.990142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.973268Z","title":"Text2video-zero: Text- to-image diffusion models are zero-shot video generators","venue":null,"work_id":"2e1d4b1b-6faf-4dd4-b61f-4d7dadddf3a2","year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.557559Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:dd469d1779edfaa510d4302c1bdc5ade2fef913c177d8860d32f024e8e1a2aeb","observation_id":"bbabc6e3-e447-4672-8494-9ad36e8c0471","resolution":{"observed_at":"2026-08-15T20:19:06.977340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.960251Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":"d032cfb9-bdfa-4e0e-9efa-222c0535fd8a","year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.562262Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:512387ce3c8943d7d522146d0358c6ba89c1b1d5c3f24ccfeca9abc794f163b6","observation_id":"f818c272-4544-463a-9670-e2cca4079e96","resolution":{"observed_at":"2026-08-15T20:19:06.964650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.942989Z","title":"Harivo: Harnessing text-to-image models for video generation","venue":null,"work_id":"bf532693-56e3-4c74-a81f-aef533ebad3d","year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.569677Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:6611d040ff41e0bc54a96828a6f444b1bfcf11df5c719b105385cdbfe768697c","observation_id":"66bf669b-8e13-42bb-8ae8-d0e9061f6322","resolution":{"observed_at":"2026-08-15T20:19:06.946880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11173","last_updated":"2023-06-19T21:32:10Z","snapshot_observed_at":"2026-08-16T15:22:44.454323Z","submitted_at":"2023-06-19T21:32:10Z","title":"GD-VDM: Generated Depth for better Diffusion-based Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11173","snapshot_observed_at":"2026-08-15T20:19:03.573520Z","title":"Gd-vdm: Generated depth for better diffusion-based video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.573520Z"},"links":{"cited_paper":"/paper/2306.11173","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:d852951d119244fb3970e90e528a5ba1236d25efe19be29f75b6a5f93e5aac17","observation_id":"fa3a50c4-bceb-46cf-b55a-6ab8d9617d06","resolution":{"observed_at":"2026-08-15T20:19:03.573520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.870366Z","title":"Movideo: Motion-aware video generation with diffusion model","venue":null,"work_id":"e8f1df90-6801-4193-8ab1-6dbb1701b3bd","year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.578535Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:39545aa9c6c9dd074c79a62e139c7454e3b28679da6463ea56b16a6baec91075","observation_id":"32e4afa2-6ee9-4737-a823-25de702c50b6","resolution":{"observed_at":"2026-08-15T20:19:06.921171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.826303Z","title":"A quick tutorial on multibody dynamics","venue":null,"work_id":"8b872a8b-48d2-4e3c-b70d-ce96ee56d912","year":2012},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.584243Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:71c6ac311e200b0949e3447d018ac588babea13ec480b16f59a68a871550466f","observation_id":"5ac07183-0a0c-47f2-b180-f6a81e46aaf7","resolution":{"observed_at":"2026-08-15T20:19:06.860532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.812495Z","title":"Physgen: Rigid-body physics-grounded image- to-video generation","venue":null,"work_id":"6ea9db6f-8b61-42a0-8195-6457e5ac814a","year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.591390Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:109fc9525887f81e2ec9dd7c8e7dbc8ed1d771504e5115ba0564997332f3931a","observation_id":"6ca6d795-de96-4c96-a606-34762711eb26","resolution":{"observed_at":"2026-08-15T20:19:06.817817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.799297Z","title":"Spe- cialist diffusion: Plug-and-play sample-efficient fine-tuning of text-to-image diffusion models to learn any unseen style","venue":null,"work_id":"f73952fb-24d2-408e-abbe-8ecc7c9c2bc5","year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.596636Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:d5be257a464b06aee43f70937cfedfe16fb034af709fe57d72c62d5e1212edcf","observation_id":"5b933013-fb4a-432a-b3d2-50433f657ca9","resolution":{"observed_at":"2026-08-15T20:19:06.803663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-13T10:28:06.516901Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-15T20:19:03.600942Z","title":"Latte: Latent diffusion transformer for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.600942Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:fe5dafca0f93dbe876ecf616ab50ba76f5383e41e687160b57b47d0755306d3f","observation_id":"86a64318-8248-489a-93cd-25884fb8c4bc","resolution":{"observed_at":"2026-08-15T20:19:03.600942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.787621Z","title":"Follow your pose: Pose- guided text-to-video generation using pose-free videos","venue":null,"work_id":"e39fe56f-42f1-40f5-8ffc-343d71ffc3a9","year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.605080Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:bf7200926a5b95b06f5f6cd471e3aa626cba56beb0fac3ff2e5461a2fba3da81","observation_id":"6f9e8311-4a80-4f00-b736-a47bbd5bb096","resolution":{"observed_at":"2026-08-15T20:19:06.792158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.737593Z","title":"Amass: Archive of motion capture as surface shapes","venue":null,"work_id":"bf1c043a-863b-4948-8a93-2aaa972df5ba","year":2019},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.610028Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:f03baf39ed3caa6eb1ee1ffc5e02c16d25327cadb5f6ac4834cd40cd31b7e43f","observation_id":"cad2a716-a9e7-4d55-b535-579b1bbf8201","resolution":{"observed_at":"2026-08-15T20:19:06.770637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.649312Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":"b5491f9c-dd6c-4f34-8476-b5e042d85e0b","year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.614293Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:de9ef987c6c59dbbcd584a2052f6bf3004ae020e33e993ef4a6548047a5768dd","observation_id":"dd61e983-3dbc-40e9-a238-0aca2a0d9ec7","resolution":{"observed_at":"2026-08-15T20:19:06.683391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.585165Z","title":"A mathematical introduction to robotic manipulation","venue":null,"work_id":"02dc1440-a1f4-4b56-a2bc-b8088b4d71bb","year":2017},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.619278Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:39118a76724f6922c18c2c3da5606277dca08cab4070fdce6ce125379f206097","observation_id":"aa2ac069-c127-4791-8648-1a3e35665eda","resolution":{"observed_at":"2026-08-15T20:19:06.615182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.626667Z","title":"Conditional image-to-video gener- ation with latent flow diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.626667Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:c7ad47ba156824608c1e8a02eba70738654844d599df165df998e6a1b6715609","observation_id":"bd3e2926-2dd5-42c0-845d-b74c8ec7f694","resolution":{"observed_at":"2026-08-15T20:19:03.626667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-15T20:19:03.635633Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models.arXiv preprint arXiv:2112.10741, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.635633Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:5f028248f7691f2b8396143212972fb0ed9a77fce5e4e21294d40acdfbaa05c5","observation_id":"7fc85a9e-f906-4285-9f37-3644ec1523d8","resolution":{"observed_at":"2026-08-15T20:19:03.635633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.566025Z","title":"Mevg: Multi-event video generation with text-to-video models","venue":null,"work_id":"99d76d28-e9ec-42b5-9f6f-c376e9852a33","year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.649845Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:d84bbb68c1e65827dce216544eb631f7c0d87f95afdf482425d00636a7453132","observation_id":"a18f8a8a-aed4-44e4-8284-86dee8233d02","resolution":{"observed_at":"2026-08-15T20:19:06.569954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.554816Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"dadfb778-62b2-4550-a19c-84c53b89a239","year":2021},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.682019Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:fc8f0df608ce0f7753eb761ab4ac66906d3f1bc48216dea56f302509a92c1c82","observation_id":"b1482aa4-fe1c-4a2a-84c4-1839deb75cf4","resolution":{"observed_at":"2026-08-15T20:19:06.558763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.750080Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.750080Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:4652ddcdd1ceaf68c270f97bada58f87547017e120620f9cc28cdf7fa1bd5e32","observation_id":"9a21b3b0-dcbf-4455-b918-c12c82cb42a6","resolution":{"observed_at":"2026-08-15T20:19:03.750080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:03.843076Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.843076Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:1719b40f5761daef87481f965c6a8c397b286dde5350fe76d6977423ff63f5cd","observation_id":"52ec9211-95a7-4bc0-8e53-884343656002","resolution":{"observed_at":"2026-08-15T20:19:03.843076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-15T20:19:03.887237Z","title":"Hierarchical text-conditional image gener- ation with clip latents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.887237Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:567b41341bb7666d6cc9a35332008e6f86a1646d1552ddad6a1f018dd59ffed7","observation_id":"aa272b0d-3b1e-436b-8fd4-d8cc1051f258","resolution":{"observed_at":"2026-08-15T20:19:03.887237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.530217Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"548e61ee-8b78-45d4-aa91-a3736c0f8eaa","year":2022},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.933182Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:fd67646fa370baa09f254a614dcbfe2e2c495f292a9705f531cd99d108d74364","observation_id":"116c50f4-c3b4-44c2-9ffb-967d670f338e","resolution":{"observed_at":"2026-08-15T20:19:06.533944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.518520Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":"a10576ab-882d-4097-9d33-392a72082f81","year":2015},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:03.983298Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:e74d9c0278684faae698388071502ee38dcb874e82ed63ab8de3374d92d7ce3c","observation_id":"9e82a81c-7e1a-40e1-beda-6a68eb6fd8b8","resolution":{"observed_at":"2026-08-15T20:19:06.522953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:04.053231Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.053231Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:040f0ffd4b83c776b1edb04fb0e2f1acb3c4e077a3bdef6f599023f16a471c09","observation_id":"4ceadf5d-9bc3-4886-8dd2-e220bb400d42","resolution":{"observed_at":"2026-08-15T20:19:04.053231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:04.117232Z","title":"Stylegan-t: Unlocking the power of gans for fast large-scale text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.117232Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:c09c287da0e1d3a9fa0afde4a2201b7127e70f81c49b950597911884d595446b","observation_id":"e526d67c-2a60-4c46-a23b-0ded63276e4c","resolution":{"observed_at":"2026-08-15T20:19:04.117232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.487479Z","title":"Find and focus: Retrieve and localize video events with natural language queries","venue":null,"work_id":"2dcceb9f-ac0c-413c-bc4a-42552a0d05b4","year":2018},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.189526Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:539a9005fed2678c4013c6a472d115740261dea7f1e7e2a3876f7c1be3aa6ff2","observation_id":"a1e7b395-22dc-498d-ac13-25793fbad6e5","resolution":{"observed_at":"2026-08-15T20:19:06.490844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.464342Z","title":"Finegym: A hierarchical video dataset for fine-grained action under- standing","venue":null,"work_id":"f15f1896-d610-4cd5-bb79-cc8bb7c75607","year":null},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.259586Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:e924b33b47e836a7d5f077fbf4fcdb2b8898f4d1f671109dd89489a63dece373","observation_id":"be137cfd-dce0-42c7-b821-50b178c8f92f","resolution":{"observed_at":"2026-08-15T20:19:06.479627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.341854Z","title":"Intra-and inter-action understanding via temporal action parsing","venue":null,"work_id":"c6800e4b-523d-4619-ba04-a641afcf95bd","year":2020},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.282516Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:d8f037227f746eaa06a3102774141b1353a2027399044aa9e37e34a4bd9af833","observation_id":"3a7e6b93-5e7a-4dec-ac2e-7b4e678ffc6c","resolution":{"observed_at":"2026-08-15T20:19:06.361893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.272073Z","title":"Neural monocular 3d human motion capture with physical awareness","venue":null,"work_id":"991b11e5-c639-49be-9851-c9f642b15fc9","year":2021},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.287494Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:24c79a74dcbd7115e6408d5c23b15001394b6579e71f1fb86b6c197ac782d509","observation_id":"6692cbce-3922-471f-a8d7-a3e73293816c","resolution":{"observed_at":"2026-08-15T20:19:06.317155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-15T20:19:04.295955Z","title":"Score-based generative modeling through stochastic differential equa- tions","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.295955Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:f3f469ee9aafb6d10c590420b98f593f556a9bc327136f3187d90c42bdb85a10","observation_id":"df2c297b-acd3-46c5-8d5a-30da29c89d99","resolution":{"observed_at":"2026-08-15T20:19:04.295955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-16T21:21:44.768787Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-15T20:19:04.305294Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.305294Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:e9b8546e8576cf6941df86fc82228dab655f86aad1a42edaa72eec7e5504d1f1","observation_id":"d9635e50-3e12-4117-9d8f-2a436796f513","resolution":{"observed_at":"2026-08-15T20:19:04.305294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.260710Z","title":"Predicting human poses via recurrent attention network","venue":null,"work_id":"34523388-58f2-4814-b1c2-c99a2fa4184f","year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.309344Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:3b8ee76d89deb465184b9dd9824d565f59b205e41651509548fac7d8173f5a7f","observation_id":"5ca95ab0-53cb-4c15-bc82-52500d944c38","resolution":{"observed_at":"2026-08-15T20:19:06.264574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:04.312572Z","title":"Eyes wide shut? exploring the visual shortcomings of multimodal llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.312572Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:ae957e0a09b284d4f856233d77c24cb4596fb274307858f9400d5be7f9df7d97","observation_id":"a40711c8-cfb8-4130-8a34-f7583e176d0d","resolution":{"observed_at":"2026-08-15T20:19:04.312572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-18T04:00:09.136122Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-15T20:19:04.315157Z","title":"To- wards accurate generative models of video: A new metric & challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.315157Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:30ed98db288077377d10736d0d9c08ad14df012c5c1e55867f82679f27c49b52","observation_id":"2875bf71-33fa-424b-af86-f5f36bf23ec3","resolution":{"observed_at":"2026-08-15T20:19:04.315157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:04.318559Z","title":"Recovering ac- curate 3d human pose in the wild using imus and a moving camera","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.318559Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:a864bbe456820e22d6535c006293b2c6819b5cbd29dca2e5f05627723281d595","observation_id":"bbbaaac6-3069-4cd1-a440-7a599f119f73","resolution":{"observed_at":"2026-08-15T20:19:04.318559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.235664Z","title":"Skeleton-in-context: Unified skeleton sequence modeling with in-context learning","venue":null,"work_id":"d314b91d-f5c9-4419-9a29-d849e64985e4","year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.322213Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:8bc1f8a256261dcbbf422ac64c6eb96093180a0f417232bfa3f7f1a01d94b570","observation_id":"29a4cf84-ee2a-4de0-9b90-7be29c81babc","resolution":{"observed_at":"2026-08-15T20:19:06.239333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:04.326414Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.326414Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:90fa2a0b44e0fefe091e550f791bcc48d62cbf7800a64c638a08a37f078e2a62","observation_id":"77de5cf2-7eff-47d9-91e9-439bbb3cae96","resolution":{"observed_at":"2026-08-15T20:19:04.326414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.216981Z","title":"Cat: a coarse-to-fine attention tree for semantic change detection","venue":null,"work_id":"e7135006-102b-49fa-9ee6-3822fdb35d2c","year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.330180Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:c07e67bc384e4aad3b601b1ffaafc6d7204942428a1075f4439744329caf6018","observation_id":"62ed9a91-6e93-4fb6-a13f-4e782a12c652","resolution":{"observed_at":"2026-08-15T20:19:06.221066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.202839Z","title":"Physics-based human motion es- timation and synthesis from videos","venue":null,"work_id":"5a7ef330-1c5c-409d-922f-443cd1a8c0db","year":2021},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.334715Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:10b41111bc702091608434f99e5c302e295fe1de35f6ecf1dd872622846c3c05","observation_id":"97be47af-ac10-4e16-b6ea-5e0dfdbde5d0","resolution":{"observed_at":"2026-08-15T20:19:06.207996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.164750Z","title":"Icon: Implicit clothed humans obtained from nor- mals","venue":null,"work_id":"0a9eb8a6-2b87-463a-b8a0-4e62fe73bec1","year":2022},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.337889Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:02eae77c468b9e3114543632360548567969f1e44564b54d19a3419c887fe10e","observation_id":"52d857f4-d113-42b9-95b7-aecd9d5165e6","resolution":{"observed_at":"2026-08-15T20:19:06.190007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:06.023371Z","title":"Econ: Explicit clothed humans optimized via normal integration","venue":null,"work_id":"62703502-5593-4b87-af97-f09e2887a3c9","year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.341096Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:0408bc6475d933e592df997a8c8b9ce1b5c816f184e7d177f506818c43ac44c3","observation_id":"f8c27189-7d0b-4740-90f4-1642a21b9ab4","resolution":{"observed_at":"2026-08-15T20:19:06.075367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:04.354989Z","title":"Dialoguenerf: Towards realistic avatar face- to-face conversation video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.354989Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:8e8eb609442131cb9fa48a2c548f4f657aad06ae4ad667628c5721d56ad94154","observation_id":"7708a617-bce6-4612-9fce-d15c7ac6c0ab","resolution":{"observed_at":"2026-08-15T20:19:04.354989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08089","snapshot_observed_at":"2026-08-15T20:19:04.432744Z","title":"Dragnuwa: Fine-grained control in video generation by integrating text, image, and trajectory","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.432744Z"},"links":{"cited_paper":"/paper/2308.08089","citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:7fc17492def3e2c519e12f79b62c4bb819694822048a1b75c8959457945b6f8a","observation_id":"1f3885c4-1c1b-4ca7-a4c1-c20caf056d5a","resolution":{"observed_at":"2026-08-15T20:19:04.432744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:04.566528Z","title":"Video probabilistic diffusion models in projected latent space","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.566528Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:34951d28248215ff7862cd04d945d8d2b9556d8809d5317874fe87fdefd8c785","observation_id":"19d69985-2187-4300-8bae-67f57ba7d463","resolution":{"observed_at":"2026-08-15T20:19:04.566528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:05.956290Z","title":"Simpoe: Simulated character control for 3d hu- man pose estimation","venue":null,"work_id":"f26791f9-7243-4b82-9a39-7202d101cbf3","year":2021},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.587990Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:a4128699fbc631b4350b2a283c25109730492c6c33cbf5f0a21cd04a4f37c67e","observation_id":"2c3d645c-2815-4e65-8e37-c52cad5711cd","resolution":{"observed_at":"2026-08-15T20:19:05.961590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:04.613063Z","title":"Physdiff: Physics-guided human motion diffusion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.613063Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:168d8cbb527a68b6afcc98db8fa51f01b120503f60352cbee073712453acd4c7","observation_id":"99013085-e542-49a3-96a6-14029634fbc0","resolution":{"observed_at":"2026-08-15T20:19:04.613063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:04.616783Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.616783Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:5078bb50e8225c7c2561b83c01ee6943ac013b7d9a41afd5feb6c40851358f81","observation_id":"8f4ef093-4ec9-44fe-922f-4c9c5140c887","resolution":{"observed_at":"2026-08-15T20:19:04.616783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:05.810503Z","title":"Physics-based interaction with 3d ob- jects via video generation","venue":null,"work_id":"78118f9b-3467-432a-9531-745777211715","year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.621574Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:28b5e67f10d23eda4ede05ffcc863dc6b76b4612c0d0fb9d3a57c4b88f1bf6d6","observation_id":"3013cd8c-6d11-4a10-9ef4-147fe0eef945","resolution":{"observed_at":"2026-08-15T20:19:05.925189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:05.797735Z","title":"Physpt: Physics-aware pretrained transformer for estimating human dynamics from monocular videos","venue":null,"work_id":"e4c66856-9e54-4608-88c1-e05a9a7dfd47","year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.625430Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:043c7af8e50b99cd9a98b79a6e6ed4ee9e01758f79f1a3df1a300a09f81d03b6","observation_id":"7ed73532-a72d-41a6-965d-b1cb93d0a1d0","resolution":{"observed_at":"2026-08-15T20:19:05.801978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:04.629361Z","title":"Incorporating physics principles for precise human motion prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.629361Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:63cc5a7f3ec789c89d9fbd3ccf3eec8085d3aa572321f589d5ad8f4df3e2b3ed","observation_id":"62e24535-b19a-47a9-a3da-694f77818804","resolution":{"observed_at":"2026-08-15T20:19:04.629361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:05.777925Z","title":"Pimnet: Physics-infused neural network for human motion prediction","venue":null,"work_id":"d4920399-2f47-4e0b-ab3f-aa4697d4ff83","year":2022},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.633180Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:bedb6f75bfe9a9b4ef3cc8f18b3f2123a1515c7bd8f847e2babcf8814f6a96ea","observation_id":"7a62b1bd-f5d5-4bc9-9667-9d98d91139f7","resolution":{"observed_at":"2026-08-15T20:19:05.783500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:05.744896Z","title":"Magdiff: Multi-alignment diffusion for high-fidelity video generation and editing","venue":null,"work_id":"1006af4c-b633-4797-9f52-0cf64665ea02","year":2024},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.637038Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:62dbe5ab378a8dad2b17467fe0697110744cebf00b2552b1f5d2d9ccdafef00f","observation_id":"cf499fed-c7d1-4f20-b899-61f0f4582e8b","resolution":{"observed_at":"2026-08-15T20:19:05.769487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:05.391455Z","title":"Motiondirector: Motion customization of text-to-video diffusion models","venue":null,"work_id":"be7a0199-ea03-42e3-89b6-c4d3d06aee72","year":2025},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.640930Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:ddce46a033dcf8860d4ef2cc8298fce0220e5bbc260ac295dc869f782fd684dc","observation_id":"9a4ba907-a098-4be0-9b38-d99dac689022","resolution":{"observed_at":"2026-08-15T20:19:05.604785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:19:05.178614Z","title":"For each gymnastics move described in the labels below, write a detailed description as if explaining to someone who is unfamiliar with gymnastics","venue":null,"work_id":"39aec11a-65b7-47af-bff0-fd89801895e2","year":2023},"citing_paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-15T20:19:04.644531Z"},"links":{"citing_paper":"/paper/2505.13437"},"observation_digest":"sha256:c75223c5f76f9ff549f3d7f854a564ec414eff787d36afda981465472a36f6d9","observation_id":"a2affa2f-f2a6-4366-92f6-3c0d516c16b5","resolution":{"observed_at":"2026-08-15T20:19:05.223129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.13437","last_updated":"2025-05-19T17:58:11Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T08:21:59.232586Z","submitted_at":"2025-05-19T17:58:11Z","title":"FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance"},"reference_resolution":{"displayed":89,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":1,"verified_fuzzy":41},"total_outbound_references":89},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 89 of 89 outbound references and 0 inbound Pith citation observations for arXiv:2505.13437."}