{"as_of":"2026-08-20T10:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:363da59c8d5988c65cf429cfdc68928a7376df12c512a0df3168245b028d77f1","coverage":[{"denominator":134,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T18:57:10.556979Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.09555/citation-record","integrity":"/paper/2509.09555/integrity","json":"/paper/2509.09555/citation-record.json","paper":"/paper/2509.09555"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.274084Z","title":"http:// mocap.cs.cmu.edu/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.274084Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:b51fbd9124236d6bfa929106c54b441b6a9ecd256dc248b3108fae5c8de0af86","observation_id":"23209582-1e4f-48ee-a081-00b32630b537","resolution":{"observed_at":"2026-08-04T18:57:10.274084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.278160Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.278160Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:658fd29d7fbed53fb0ef127b71c17f445fe717b79d8396bcbc5d8d912c06b867","observation_id":"2806ad5a-c747-46ff-88cb-ac9551f3d895","resolution":{"observed_at":"2026-08-04T18:57:10.278160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.281211Z","title":"Pmp: Learning to physically interact with environments using part-wise motion priors","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.281211Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:0a2dab67db8e50c02de90f1df61c34e06eaa500d09eb0be12fd53e38a76f548f","observation_id":"ce172e8b-c3e9-4c99-a9de-68d6df173f51","resolution":{"observed_at":"2026-08-04T18:57:10.281211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.284261Z","title":"BEHA VE: Dataset and method for tracking human object interactions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.284261Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:d6874a3d845759b5606c2b2db88b82431ec91f6fc6bf49af0211ab3da4ef3c50","observation_id":"c9a8998c-1263-421e-b304-4bd32e312498","resolution":{"observed_at":"2026-08-04T18:57:10.284261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.287298Z","title":"Bedlam: A synthetic dataset of bodies exhibiting detailed lifelike animated motion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.287298Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:070fdfb9b3edfefeaa06a646052ca7847ec2822a842c8ff8bfa94e2e938e606c","observation_id":"e2f89e05-31ec-44cd-804f-3b069c739438","resolution":{"observed_at":"2026-08-04T18:57:10.287298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07907","last_updated":"2023-09-14T17:55:18Z","snapshot_observed_at":"2026-08-19T08:21:11.819023Z","submitted_at":"2023-09-14T17:55:18Z","title":"Physically Plausible Full-Body Hand-Object Interaction Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07907","snapshot_observed_at":"2026-08-04T18:57:10.290405Z","title":"Physically plausible full- body hand-object interaction synthesis.arXiv preprint arXiv:2309.07907, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.290405Z"},"links":{"cited_paper":"/paper/2309.07907","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:ae767f469b3269956b9970970123f8c728f74e2dedc4008788c42431f97e7275","observation_id":"647fe5b6-7c63-4923-9b70-afec734fd5ff","resolution":{"observed_at":"2026-08-04T18:57:10.290405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.293555Z","title":"Lan- guage models are few-shot learners","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.293555Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:10aaa469dd0ede4680f85996e65ea344adb4af0be3fea76cb56a8f26bd183502","observation_id":"dbb1139d-a43c-4c69-a54c-8ec8b30c1599","resolution":{"observed_at":"2026-08-04T18:57:10.293555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.296554Z","title":"Long-term human motion prediction with scene context","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.296554Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:a4d78ecc801631c74d80bfcf870648699b6b9bb3ec07cc0b4b7c89adcd35f88e","observation_id":"1b016db7-4be6-4e44-b80b-ed4759497612","resolution":{"observed_at":"2026-08-04T18:57:10.296554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.299484Z","title":"Text2hoi: Text-guided 3d motion generation for hand- object interaction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.299484Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:e8fd64bf5e53023b3ffa7eda578d8925f3731d6b8ee6db4bac3fbd59eced0b26","observation_id":"b5e5dfd9-aa02-4dd2-a4ee-6df5396f63c6","resolution":{"observed_at":"2026-08-04T18:57:10.299484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.302358Z","title":"Learning to sit: Synthesizing human-chair interactions via hierarchical control","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.302358Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:cdd844b1e0835ccb54c9495e013b54eb127fac8434e7ce28428f07cd956f1536","observation_id":"30fb5a14-b349-4b62-a7a3-146bb030675f","resolution":{"observed_at":"2026-08-04T18:57:10.302358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.305176Z","title":"Dexycb: A benchmark for capturing hand grasping of objects","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.305176Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:f84c2e1a48a554902180c92c9d156e5b389437921e38e0c7d030c0249d07e1ce","observation_id":"5c10c3ea-e0f4-4d1c-99b7-80a1026d46b2","resolution":{"observed_at":"2026-08-04T18:57:10.305176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11684","last_updated":"2024-06-17T07:55:59Z","snapshot_observed_at":"2026-07-06T17:31:53.996417Z","submitted_at":"2024-02-18T19:26:49Z","title":"ALLaVA: Harnessing GPT4V-Synthesized Data for Lite Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11684","snapshot_observed_at":"2026-08-04T18:57:10.308113Z","title":"Allava: Harnessing gpt4v-synthesized data for a lite vision-language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.308113Z"},"links":{"cited_paper":"/paper/2402.11684","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:09c97129ea87d61550744ce32ff6d62e6a7a31c1894806445629d28c507043ac","observation_id":"11029495-1e23-44bf-945f-aa1297ea12f3","resolution":{"observed_at":"2026-08-04T18:57:10.308113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17827","last_updated":"2024-12-23T17:36:22Z","snapshot_observed_at":"2026-08-16T14:06:12.412340Z","submitted_at":"2024-03-26T16:06:42Z","title":"DiffH2O: Diffusion-Based Synthesis of Hand-Object Interactions from Textual Descriptions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17827","snapshot_observed_at":"2026-08-04T18:57:10.311241Z","title":"Diffh2o: Diffusion-based synthesis of hand- object interactions from textual descriptions.arXiv preprint arXiv:2403.17827, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.311241Z"},"links":{"cited_paper":"/paper/2403.17827","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:f71fddcf15f1701601154a15492f7f44a6a58559c8fa97348466a81adb9ad86c","observation_id":"370690f0-3647-4664-b726-af0e1c624a07","resolution":{"observed_at":"2026-08-04T18:57:10.311241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.314427Z","title":"Context-aware human motion prediction","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.314427Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:00eecc50492fe561f40f08706042a443712a56fe74b4ae7cb8c1a1422776b3d7","observation_id":"4b98d6bc-8ffc-403c-8ead-85d5d0d94a42","resolution":{"observed_at":"2026-08-04T18:57:10.314427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.317162Z","title":"AnySkill: Learning open- vocabulary physical skill for interactive agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.317162Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:3fd332ae20822611879bb487cec85fcaa7add9ad863d2ddc97fe76af67349f36","observation_id":"88e3bd4a-ad59-4d29-89a7-7d63572821c4","resolution":{"observed_at":"2026-08-04T18:57:10.317162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.320001Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.320001Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:16a9ebef33e3d81cad260f03638ca07a96e3b3c59984f12d1ca7fed33191f294","observation_id":"97b205ca-5f62-4c8a-a477-9a4f7eea904c","resolution":{"observed_at":"2026-08-04T18:57:10.320001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.322760Z","title":"Exploiting cyclic symmetry in convolutional neural net- works","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.322760Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:b7ba6aef8b0e7327eef763ea9100658b7fd5b11e175fe681f301bfd40e6a0328","observation_id":"c272eb8e-5aba-41d4-8332-fca055b0c89f","resolution":{"observed_at":"2026-08-04T18:57:10.322760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.325661Z","title":"CG-HOI: Contact-guided 3d human-object interaction generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.325661Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:4e303c9b517176ba2f2ab4bb8551eb310b566dc9de7a5d6d72766f3d8fa2ba4a","observation_id":"6ea76ff0-de51-41cb-9cce-058fd47867ea","resolution":{"observed_at":"2026-08-04T18:57:10.325661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.328501Z","title":"Scaling laws of synthetic images for model training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.328501Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:7b42293e7c831551d92f323fac8c72527f4c79465fc1ecd7a7ab16021196b5bd","observation_id":"f184bdda-2bfd-4035-8191-c34f480a71f7","resolution":{"observed_at":"2026-08-04T18:57:10.328501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.331156Z","title":"Black, and Otmar Hilliges","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.331156Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:2bb505b61fe38716d68c8f2bcf6e29ae58c41fe15fc578611e989392dc6e6ebd","observation_id":"b240a71d-7d9e-4b3f-9fa1-f05b63774f0e","resolution":{"observed_at":"2026-08-04T18:57:10.331156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.07555","last_updated":"2023-02-26T12:38:55Z","snapshot_observed_at":"2026-08-16T16:08:33.891571Z","submitted_at":"2022-12-14T23:59:24Z","title":"IMos: Intent-Driven Full-Body Motion Synthesis for Human-Object Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.07555","snapshot_observed_at":"2026-08-04T18:57:10.333991Z","title":"IMoS: Intent-driven full-body motion synthesis for human-object interactions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.333991Z"},"links":{"cited_paper":"/paper/2212.07555","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:adcefa44644889efe33ee9a22ad4a777cbf989d581cdb12d537bd966e9e8fc59","observation_id":"e6407693-117d-41f7-a590-5c401072c759","resolution":{"observed_at":"2026-08-04T18:57:10.333991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.337484Z","title":"Generating diverse and natural 3d human motions from text","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.337484Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:c1c3d30f2eae33dd8d81b92a109fd91d836e6750ae96da02e6571abb5bdf78f2","observation_id":"f86c6f61-8ba9-46ba-8349-1d4506341d8d","resolution":{"observed_at":"2026-08-04T18:57:10.337484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.340005Z","title":"Honnotate: A method for 3d annotation of hand and object poses","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.340005Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:ff0a26b81f207bbccfc23fd8964bb3eca9d8cb69d8b54963c86891e2d0b6b455","observation_id":"de89e441-f8a2-437d-87ff-e7c6f1080597","resolution":{"observed_at":"2026-08-04T18:57:10.340005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.342625Z","title":"Resolving 3d human pose ambiguities with 3d scene constraints","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.342625Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:7aa4cc834daea852438db57cd700cf42cd67fc04443f7b9b0aa48e54fc1b1875","observation_id":"10fe08c3-710d-4efa-9d6d-8b5f907c829c","resolution":{"observed_at":"2026-08-04T18:57:10.342625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.345121Z","title":"Stochastic scene- aware motion prediction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.345121Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:26e215a2391247f1aa51a275254d099ecd295b0256a33b7ffae3f45f5fd73f78","observation_id":"85365ad5-fde9-4ce9-992c-71699df29d8e","resolution":{"observed_at":"2026-08-04T18:57:10.345121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.347994Z","title":"Synthesizing physi- cal character-scene interactions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.347994Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:f840ef17242f07cb03173cece886cfc7d6a8ec971ea91c3292f98f78f6d216fc","observation_id":"eb233d2c-eb2c-4261-9267-95a994722c2f","resolution":{"observed_at":"2026-08-04T18:57:10.347994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14070","last_updated":"2023-04-27T10:04:56Z","snapshot_observed_at":"2026-08-16T20:11:41.412631Z","submitted_at":"2023-04-27T10:04:56Z","title":"Compositional 3D Human-Object Neural Animation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14070","snapshot_observed_at":"2026-08-04T18:57:10.350678Z","title":"Composi- tional 3d human-object neural animation.arXiv preprint arXiv:2304.14070, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.350678Z"},"links":{"cited_paper":"/paper/2304.14070","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:7135ae234c1ec7bc81817163a6ea7651c32e97041f18cbf141e14e2985d0a934","observation_id":"6fc92da0-eb54-49d6-a4dd-8c70b3129acf","resolution":{"observed_at":"2026-08-04T18:57:10.350678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.353626Z","title":"Black, and Dim- itrios Tzionas","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.353626Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:32432a7070afa9f989694ab6ecc8560fa819fd719c75e74fec394917fa94ecad","observation_id":"ff724229-eed9-4505-8883-2cd9275fcfbf","resolution":{"observed_at":"2026-08-04T18:57:10.353626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.356220Z","title":"CHAIRS: Towards full-body articulated human-object interaction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.356220Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:296358aa2b180c36c99f0d53fd22efeeb62a766597662dd68d8b49c37c3a0890","observation_id":"b6e9f3de-53a2-4e93-bc5e-7b7039a7abae","resolution":{"observed_at":"2026-08-04T18:57:10.356220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.358809Z","title":"Scaling up dynamic human-scene interaction mod- eling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.358809Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:5d8663a09e8ec47ade9a49aa44cd0a567022b30de7e159d74d86ee66c64e2ab4","observation_id":"1c6e4826-197f-4d64-86fe-406352f58051","resolution":{"observed_at":"2026-08-04T18:57:10.358809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.361292Z","title":"From skin to skeleton: Towards biomechanically accurate 3d digital humans.ACM Transactions on Graphics (TOG), 42(6):1–12,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.361292Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:a1496b509735665bd5ebb4fd960e68795ace956633c2481160afc458e0169243","observation_id":"0518cec9-a914-4121-b150-8426e3bdc70e","resolution":{"observed_at":"2026-08-04T18:57:10.361292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10232","last_updated":"2025-01-22T07:00:51Z","snapshot_observed_at":"2026-08-16T14:26:21.196489Z","submitted_at":"2024-01-18T18:59:58Z","title":"ParaHome: Parameterizing Everyday Home Activities Towards 3D Generative Modeling of Human-Object Interactions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10232","snapshot_observed_at":"2026-08-04T18:57:10.364075Z","title":"ParaHome: Parameterizing everyday home activities to- wards 3d generative modeling of human-object interactions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.364075Z"},"links":{"cited_paper":"/paper/2401.10232","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:dd3f15f5ce33473bf9a73cac81138a80da2d914cd1bef68bfaeace953c7db818","observation_id":"e7e0d1c5-4d35-4abe-8614-497e0aca990a","resolution":{"observed_at":"2026-08-04T18:57:10.364075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.367014Z","title":"NCHO: Unsupervised learning for neural 3d composition of humans and objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.367014Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:1db32ac1aba5bc8a34565974f880175c9a835246d9cd9f0943b798bea0c205f4","observation_id":"6bee9197-77c1-4196-89b5-8be230657af6","resolution":{"observed_at":"2026-08-04T18:57:10.367014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.369701Z","title":"The kit bimanual manipulation dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.369701Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:fd31b8c5fb94091289940f392389e43216e14144d06e9bfcb9d0009f5464dd7b","observation_id":"5d959e52-1ee0-4af9-b18f-5a0ca6bbd1b8","resolution":{"observed_at":"2026-08-04T18:57:10.369701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07511","last_updated":"2023-07-14T17:59:38Z","snapshot_observed_at":"2026-08-16T15:16:09.684075Z","submitted_at":"2023-07-14T17:59:38Z","title":"NIFTY: Neural Object Interaction Fields for Guided Human Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07511","snapshot_observed_at":"2026-08-04T18:57:10.372377Z","title":"NIFTY: Neural object interaction fields for guided human motion synthesis.arXiv preprint arXiv:2307.07511, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.372377Z"},"links":{"cited_paper":"/paper/2307.07511","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:4be7009b04bf41747d35549e78ffa31546f1f87c9bc14dcd28329a6e5ecaa39d","observation_id":"67788e1f-4a34-42a5-80be-1ed84fab1484","resolution":{"observed_at":"2026-08-04T18:57:10.372377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.375127Z","title":"Locomotion-Action- Manipulation: Synthesizing human-scene interactions in complex 3d environments","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.375127Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:d008c88741546b09408c7e390928e528b71a3e6e76de383bdb167f416f769328","observation_id":"59c0da3d-9085-41a2-8fba-4f6a4b63ef50","resolution":{"observed_at":"2026-08-04T18:57:10.375127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03913","last_updated":"2024-07-14T23:00:54Z","snapshot_observed_at":"2026-08-19T16:49:17.280094Z","submitted_at":"2023-12-06T21:14:20Z","title":"Controllable Human-Object Interaction Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03913","snapshot_observed_at":"2026-08-04T18:57:10.377790Z","title":"Controllable human-object in- teraction synthesis.arXiv preprint arXiv:2312.03913, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.377790Z"},"links":{"cited_paper":"/paper/2312.03913","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:af076fa53d0a5af949a6cc3de60c7a47f95cd26d8f0aab8bb0bc96929c09e202","observation_id":"886a2d0b-8589-4447-a24f-14718772ce88","resolution":{"observed_at":"2026-08-04T18:57:10.377790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.380748Z","title":"Object motion guided human motion synthesis.ACM Transactions on Graphics (TOG), 42(6):1–11, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.380748Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:f0ccd2e261b6919816ea1d2ab2d22e81f7fd06c84ea03eb0fe296ae5d8a70915","observation_id":"ada21ff3-e81d-41ef-bf02-81a8c9313b4d","resolution":{"observed_at":"2026-08-04T18:57:10.380748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13129","last_updated":"2023-11-04T03:47:12Z","snapshot_observed_at":"2026-08-16T15:46:00.115294Z","submitted_at":"2023-03-23T09:31:56Z","title":"Task-Oriented Human-Object Interactions Generation with Implicit Neural Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13129","snapshot_observed_at":"2026-08-04T18:57:10.383440Z","title":"Task-oriented human-object interactions genera- tion with implicit neural representations.arXiv preprint arXiv:2303.13129, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.383440Z"},"links":{"cited_paper":"/paper/2303.13129","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:0519767edfe11c1115c4c00f3b7e0622b583ec9ef70ceb022a29eb4096452d82","observation_id":"d5ee9926-df31-45c1-9364-748a5aaaa93f","resolution":{"observed_at":"2026-08-04T18:57:10.383440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05684","last_updated":"2024-03-28T03:15:57Z","snapshot_observed_at":"2026-08-16T15:41:04.861577Z","submitted_at":"2023-04-12T08:12:29Z","title":"InterGen: Diffusion-based Multi-human Motion Generation under Complex Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05684","snapshot_observed_at":"2026-08-04T18:57:10.386641Z","title":"InterGen: Diffusion-based multi-human motion generation under complex interactions.arXiv preprint arXiv:2304.05684, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.386641Z"},"links":{"cited_paper":"/paper/2304.05684","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:2aa0fa99fc40763b51ded5ee51693bb96f65356397d0bb4a3035ebfdf8151d44","observation_id":"23412492-f07a-4cae-b6ee-44897ed69491","resolution":{"observed_at":"2026-08-04T18:57:10.386641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.389598Z","title":"Motion-X: A large- scale 3d expressive whole-body human motion dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.389598Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:a8318f3668dee7fd4dbd9ca1328a4e4be499c04452d87e29e6281e75ba6191be","observation_id":"ceb526b7-086d-4c2b-8249-01636c98f166","resolution":{"observed_at":"2026-08-04T18:57:10.389598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.392743Z","title":"Learning basketball drib- bling skills using trajectory optimization and deep reinforce- ment learning.ACM Transactions on Graphics (TOG), 37 (4):1–14, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.392743Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:8f96c47ef0ba2562afe4f7bf588492e6995093e5da32906142a84336c177d667","observation_id":"066e0de2-82b3-4f23-b064-a26b6f5e058d","resolution":{"observed_at":"2026-08-04T18:57:10.392743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.395799Z","title":"Contactgen: Generative contact modeling for grasp generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.395799Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:3ed51a616ef8590859e3d1c2343a6fd3281d8a902f9d2daee4da38fdc221dfd8","observation_id":"fc97bb40-d3d7-457a-abb7-a8c5bcbff7ea","resolution":{"observed_at":"2026-08-04T18:57:10.395799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.398552Z","title":"Hoi4d: A 4d egocentric dataset for category-level human- object interaction","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.398552Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:f25630d536d55a968554268afed1f78df4cdd26cedf33fbea7e2b7aed838a93c","observation_id":"f5c0c089-b353-4785-ad57-71a71afb7e72","resolution":{"observed_at":"2026-08-04T18:57:10.398552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.401123Z","title":"SMPL: A skinned multi- person linear model.ACM transactions on graphics, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.401123Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:9de8c16c164d135a32348261dbff0f20530ff6033301eaaac7348c135f52c43f","observation_id":"87e8d768-fff2-46fc-863f-f29be8042b71","resolution":{"observed_at":"2026-08-04T18:57:10.401123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12978","last_updated":"2023-10-19T17:59:46Z","snapshot_observed_at":"2026-08-18T12:29:37.071756Z","submitted_at":"2023-10-19T17:59:46Z","title":"HumanTOMATO: Text-aligned Whole-body Motion Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12978","snapshot_observed_at":"2026-08-04T18:57:10.403659Z","title":"Hu- mantomato: Text-aligned whole-body motion generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.403659Z"},"links":{"cited_paper":"/paper/2310.12978","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:b887db6f12e3d46e498d4e63566d384eae928631b3e174b9b2fdc2ec85e82b2e","observation_id":"84240c9f-e38f-4875-b98a-5091ea883426","resolution":{"observed_at":"2026-08-04T18:57:10.403659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00187","last_updated":"2024-06-28T18:53:05Z","snapshot_observed_at":"2026-08-16T19:19:32.506013Z","submitted_at":"2024-06-28T18:53:05Z","title":"SMPLOlympics: Sports Environments for Physically Simulated Humanoids","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00187","snapshot_observed_at":"2026-08-04T18:57:10.406511Z","title":"Smplolympics: Sports environ- ments for physically simulated humanoids.arXiv preprint arXiv:2407.00187, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.406511Z"},"links":{"cited_paper":"/paper/2407.00187","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:6811f8ab16436b033dfe4dd6661b621633b22852e379c41d2a6f43b541a8f886","observation_id":"7b3c0dd7-0c45-4544-a3e9-c7a1bce766c5","resolution":{"observed_at":"2026-08-04T18:57:10.406511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.409084Z","title":"Himo: A new benchmark for full-body human interacting with multiple objects","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.409084Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:01267a01573bece4a2c1dca0121f312da4140bf355482420d5332699b064396b","observation_id":"dda2a7ad-0685-46f4-b962-fbf39785584a","resolution":{"observed_at":"2026-08-04T18:57:10.409084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.411709Z","title":"Diff-ip2d: Diffusion-based hand-object interaction predic- tion on egocentric videos.arXiv preprint arXiv:2405.04370,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.411709Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:830a11271f518062a867cd2dd0c55b732b07bdbb2555db3f3963f4bda142016c","observation_id":"5391900d-2f3a-4002-9dc2-b5a92b1f74a8","resolution":{"observed_at":"2026-08-04T18:57:10.411709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.414926Z","title":"AMASS: Archive of motion capture as surface shapes","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.414926Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:eac37add73cbb265f738da06f66f36c9d946bfaad127a277158c1bb362102c3c","observation_id":"85139f07-5dda-4f46-8ac3-87302d84fd9f","resolution":{"observed_at":"2026-08-04T18:57:10.414926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10470","last_updated":"2021-08-25T23:42:59Z","snapshot_observed_at":"2026-07-06T11:40:56.544714Z","submitted_at":"2021-08-24T01:38:11Z","title":"Isaac Gym: High Performance GPU-Based Physics Simulation For Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.10470","snapshot_observed_at":"2026-08-04T18:57:10.417501Z","title":"Isaac gym: High performance gpu-based physics simulation for robot learning.arXiv preprint arXiv:2108.10470, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.417501Z"},"links":{"cited_paper":"/paper/2108.10470","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:e1300876993df7ad303cb808c99f9842f1f5524a483d89d2418ded4af1fb86c7","observation_id":"108898d8-8ce7-4ded-97cc-ab3afbdc832b","resolution":{"observed_at":"2026-08-04T18:57:10.417501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.420289Z","title":"The kit whole-body human motion database","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.420289Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:3244d77c9b9c38f4ccaf9f284a8e7fdb317c08b80b98e80391079a1d4ebf7468","observation_id":"60bbf33d-984e-46c3-97c0-d0d749100519","resolution":{"observed_at":"2026-08-04T18:57:10.420289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.422726Z","title":"Unifying representations and large-scale whole-body motion databases for studying human motion.IEEE Transactions on Robotics, 32(4):796– 809, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.422726Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:7a09fdb07d832f6cc9457b8fcdf0dd75bce97cbe8c03989cb31042f8e7757d65","observation_id":"e6e12aa9-7f1a-4109-866b-4b36eaa6aaf5","resolution":{"observed_at":"2026-08-04T18:57:10.422726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.425203Z","title":"Single-shot multi-person 3D pose estimation from monocular RGB","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.425203Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:69e53cc792e9c6016ffd65530c0634e803e96bd37bbf4c11c94328ccf742db68","observation_id":"83bbc1f9-8973-40c5-a195-466f90aefed8","resolution":{"observed_at":"2026-08-04T18:57:10.425203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.427804Z","title":"Catch & carry: reusable neu- ral controllers for vision-guided whole-body tasks.ACM Transactions on Graphics (TOG), 39(4):39–1, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.427804Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:ce320dfbd4f161208618f8a7429c82723c0be35b56903ff7ecf9282344a5cdc6","observation_id":"0b78c26a-00e1-46cd-88a5-c07fcca5785e","resolution":{"observed_at":"2026-08-04T18:57:10.427804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.432287Z","title":"Interhand2","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.432287Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:2e9ad37d5ba68eca3b9fbedb2901b8854196c24d530b756d783b293e9fbf3a17","observation_id":"7e2caad6-6656-466a-a557-810cfbac41c3","resolution":{"observed_at":"2026-08-04T18:57:10.432287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.435125Z","title":"Dataset diffusion: Diffusion-based synthetic data generation for pixel-level semantic segmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.435125Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:f73ecccd0a6cf87e16ab32b9bebc012118dd6595e168cdd197ad006008e9f4e1","observation_id":"bead03f2-cdec-44e0-a5be-e9997f2c7efa","resolution":{"observed_at":"2026-08-04T18:57:10.435125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.438441Z","title":"Assemblyhands: Towards ego- centric activity understanding via 3d hand pose estimation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.438441Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:15b2162a48813bb3a2f012fcbe81cdc5058f872a7a698637c516cf1c2365466e","observation_id":"200bca8d-b1ec-48a8-9e97-8a3af30b10aa","resolution":{"observed_at":"2026-08-04T18:57:10.438441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-08-14T18:53:38.574749Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-04T18:57:10.441044Z","title":"Repre- sentation learning with contrastive predictive coding.arXiv preprint arXiv:1807.03748, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.441044Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:7739e27341b7dc94454f16b03971677c621d47445c402b60b1be992608778fd6","observation_id":"d2896900-6835-4168-92a7-31109e875159","resolution":{"observed_at":"2026-08-04T18:57:10.441044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.444144Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.444144Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:f7d8b63c2b0c946d8b5f79a44240bc5abf9e190fa9aad76239a7ba6a2e005328","observation_id":"1602d422-50b1-4a1f-9e16-a654859ad3a4","resolution":{"observed_at":"2026-08-04T18:57:10.444144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09036","last_updated":"2025-03-02T17:15:30Z","snapshot_observed_at":"2026-08-18T20:32:12.388478Z","submitted_at":"2023-08-17T15:17:49Z","title":"Synthesizing Physically Plausible Human Motions in 3D Scenes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09036","snapshot_observed_at":"2026-08-04T18:57:10.446905Z","title":"Synthesizing physically plausible human motions in 3d scenes.arXiv preprint arXiv:2308.09036, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.446905Z"},"links":{"cited_paper":"/paper/2308.09036","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:9b686b60597edefdf1e5b5e071c83e8d3539c21747051f74f1ac5765f1a00ca9","observation_id":"7dc6283e-acc2-4645-b05e-042d7a571d97","resolution":{"observed_at":"2026-08-04T18:57:10.446905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.449468Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.449468Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:6b9b6aa27e5f8987f79bf5b0da261b670696bf214abbcd953fbb215b7a9e5643","observation_id":"c4870068-209d-4742-8539-91ff7efeb89b","resolution":{"observed_at":"2026-08-04T18:57:10.449468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06553","last_updated":"2025-07-07T05:09:32Z","snapshot_observed_at":"2026-08-16T14:35:48.170640Z","submitted_at":"2023-12-11T17:41:17Z","title":"HOI-Diff: Text-Driven Synthesis of 3D Human-Object Interactions using Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06553","snapshot_observed_at":"2026-08-04T18:57:10.451963Z","title":"HOI-Diff: Text-driven syn- thesis of 3d human-object interactions using diffusion mod- els.arXiv preprint arXiv:2312.06553, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.451963Z"},"links":{"cited_paper":"/paper/2312.06553","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:6f55c395523a7ee4e7eb4c900092cd26d22463f0bfe24ebe285ab02193534da1","observation_id":"5b7ad611-f3a8-4f53-98bb-90305b69002f","resolution":{"observed_at":"2026-08-04T18:57:10.451963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.454779Z","title":"Object pop-up: Can we infer 3d objects and their poses from human interactions alone? InCVPR, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.454779Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:b3713114afb35413070651ff3976ce750157004b5f7bb296fde0651e09f7496d","observation_id":"18050da0-9444-453d-8fde-9f9392eb6a54","resolution":{"observed_at":"2026-08-04T18:57:10.454779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.457250Z","title":"Black, and G¨ul Varol","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.457250Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:104d664292c02e8a5002c66e276e4e7ebd5c1de6b606328af3fa1dc8e2fd30a2","observation_id":"78591db3-9364-465c-8adf-63e065b6d1d7","resolution":{"observed_at":"2026-08-04T18:57:10.457250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.460326Z","title":"TMR: Text-to-motion retrieval using contrastive 3d human motion synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.460326Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:b12533e2e4bbb09c9236abf41143ef165142e14a47b80d8e37ba7b96dbd002a9","observation_id":"9f186511-d63f-4b83-b88e-c5e15c05fe24","resolution":{"observed_at":"2026-08-04T18:57:10.460326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.462991Z","title":"The kit motion-language dataset.Big data, 4(4):236–252,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.462991Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:5a2f9215fdf81c3888a6e5b51a1e502164485235df6b7b9c0b7ab3ad4e92cdaa","observation_id":"27dcd75e-4179-465f-9b0a-d343c0cfa864","resolution":{"observed_at":"2026-08-04T18:57:10.462991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.465761Z","title":"Efficient learning on point clouds with basis point sets","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.465761Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:d409253900e29b446b6d3680663dfc44f161758c839931e5870ac961f8004c34","observation_id":"d352dce9-4e55-41c6-b5ad-1dd3fa32a5ab","resolution":{"observed_at":"2026-08-04T18:57:10.465761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.468437Z","title":"Punnakkal, Arjun Chandrasekaran, Nikos Athanasiou, Alejandra Quiros-Ramirez, and Michael J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.468437Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:3840ce0a23a55ef35904443dd8d6939ff1e54b87dd09a6f0c0d349ae9f0b78fe","observation_id":"26252ae6-7ae3-4389-a23e-b2bb14e86962","resolution":{"observed_at":"2026-08-04T18:57:10.468437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.471072Z","title":"Pointnet++: Deep hierarchical feature learning on point sets in a metric space","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.471072Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:ebc4e9670f806f867ebe20b2710e64caecd81935424cbbb2721c1bf4d68f83e8","observation_id":"9b68617c-5074-4f92-a20f-a3917305034f","resolution":{"observed_at":"2026-08-04T18:57:10.471072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.473682Z","title":"Action-conditioned gen- eration of bimanual object manipulation sequences","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.473682Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:f9a11d340ae0811db70ad9eeb81dd19be5c6cd99c9285134b11a41f82f056271","observation_id":"daf76e1f-a93c-48e4-93c1-9a6fca70f7e1","resolution":{"observed_at":"2026-08-04T18:57:10.473682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-08-14T05:02:11.716316Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-04T18:57:10.476425Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks.arXiv preprint arXiv:1908.10084, 2019","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.476425Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:95bceebd5a59096881f394dea1508cd3d2134432be0924c93fdc1821051a7c7e","observation_id":"20ffdb13-cd73-450e-b152-64d797342461","resolution":{"observed_at":"2026-08-04T18:57:10.476425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.479240Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.479240Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:c414edcba2c0dfe664af40dd2443bf5c8978b262c16e8fe440bf281e3a7c058d","observation_id":"40fdc2c7-ca61-469c-be4d-40931c53d745","resolution":{"observed_at":"2026-08-04T18:57:10.479240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.482367Z","title":"Hoianimator: Generating text-prompt human-object anima- tions using novel perceptive diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.482367Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:b8c6de9d3b7cb84d900f23beee81ccadc85b4442ef9a2a2a02fbe034a6f393a7","observation_id":"81a29599-2cf5-46d8-95e2-9cf896c8d1c6","resolution":{"observed_at":"2026-08-04T18:57:10.482367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.485190Z","title":"Neural state machine for character-scene interactions.ACM Trans","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.485190Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:529cb71e98b9f280ef71d7dd60a5ffc7cedae07faf1ba51c21f1c851110e156a","observation_id":"d415f0c0-60b9-450a-95ae-0bff93f416fb","resolution":{"observed_at":"2026-08-04T18:57:10.485190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.488215Z","title":"Local motion phases for learning multi-contact char- acter movements.ACM Transactions on Graphics (TOG), 39(4):54–1, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.488215Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:0de8fe39365070e7fdda9db4afd1c573807a972151b9a5affad52cde04d4df1d","observation_id":"05216504-15f8-4571-b926-6747c50b888e","resolution":{"observed_at":"2026-08-04T18:57:10.488215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.490915Z","title":"GRAB: A dataset of whole-body human grasping of objects","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.490915Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:6c3f12e343ebe8b927b65bab02f704f889f69e11703beced416edbb2d7bf4421","observation_id":"3da2d302-8d29-4f61-b6a8-23a2bc343f95","resolution":{"observed_at":"2026-08-04T18:57:10.490915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.493490Z","title":"GOAL: Generating 4d whole-body motion for hand-object grasping","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.493490Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:99e8c9347b58be5dae3e0558c5fc66fd16975fe01e68a54cd1cee068f44d67b9","observation_id":"15f182c0-884f-4639-949a-b667a96e8179","resolution":{"observed_at":"2026-08-04T18:57:10.493490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.496167Z","title":"Grip: Generating interaction poses using spatial cues and latent consistency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.496167Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:1b93ab86316d5ba388d5f750f8eaca8d6fe88703787604e8a14da70efac318c2","observation_id":"d5af08e7-6adc-4586-a314-a5efda5971aa","resolution":{"observed_at":"2026-08-04T18:57:10.496167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.498922Z","title":"Flex: Full-body grasping without full-body grasps","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.498922Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:feb2c989a1cc6f88a32217ca138c872f3844ed8892f12e87221869e9a115bb0a","observation_id":"2d7f8d50-bd39-4dea-a4bb-a5ded28b1ebd","resolution":{"observed_at":"2026-08-04T18:57:10.498922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14393","last_updated":"2024-09-22T11:10:59Z","snapshot_observed_at":"2026-08-16T13:16:32.391270Z","submitted_at":"2024-09-22T11:10:59Z","title":"MaskedMimic: Unified Physics-Based Character Control Through Masked Motion Inpainting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14393","snapshot_observed_at":"2026-08-04T18:57:10.501695Z","title":"Maskedmimic: Unified physics-based charac- ter control through masked motion inpainting.arXiv preprint arXiv:2409.14393, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.501695Z"},"links":{"cited_paper":"/paper/2409.14393","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:f46ad957d3fad3bc1c1fbeecbd0963fd9bd08656ff21c366f8ffe47e5eacfcc6","observation_id":"33555ad6-ca2e-4db8-8aeb-a050de9874a5","resolution":{"observed_at":"2026-08-04T18:57:10.501695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14916","last_updated":"2022-10-03T09:17:41Z","snapshot_observed_at":"2026-08-12T18:48:37.916493Z","submitted_at":"2022-09-29T16:27:53Z","title":"Human Motion Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14916","snapshot_observed_at":"2026-08-04T18:57:10.504951Z","title":"Human motion diffusion model.arXiv preprint arXiv:2209.14916, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.504951Z"},"links":{"cited_paper":"/paper/2209.14916","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:7921958895b4e9c9ba09320c78d0a5dc7bd341be2e661e3f737b503e5a83b94d","observation_id":"e2860beb-15ad-4f57-946c-80955f53fc00","resolution":{"observed_at":"2026-08-04T18:57:10.504951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03441","last_updated":"2024-10-04T13:56:48Z","snapshot_observed_at":"2026-08-16T13:12:34.424178Z","submitted_at":"2024-10-04T13:56:48Z","title":"CLoSD: Closing the Loop between Simulation and Diffusion for multi-task character control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03441","snapshot_observed_at":"2026-08-04T18:57:10.507907Z","title":"Closd: Closing the loop between simulation and diffusion for multi-task character control.arXiv preprint arXiv:2410.03441, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.507907Z"},"links":{"cited_paper":"/paper/2410.03441","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:b1d8f44bb2cff3c6f71f64be9f319f6ef5afd0be5f91ba72a043f67ab0afb912","observation_id":"ad3d4ee7-6095-4b3a-8774-c4c25276acc2","resolution":{"observed_at":"2026-08-04T18:57:10.507907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.510897Z","title":"Gaze-guided hand-object in- teraction synthesis: Benchmark and method.arXiv preprint arXiv:2403.16169, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.510897Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:1167c4a2bb5704d4790b921bcb93fb6074969218f395cc0d82735586754a6e1a","observation_id":"79fceed7-0807-4416-accb-5773f7eb00f1","resolution":{"observed_at":"2026-08-04T18:57:10.510897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.513658Z","title":"Learn to predict how hu- mans manipulate large-sized objects from interactive mo- tions.IEEE Robotics and Automation Letters, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.513658Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:92b30102f2e2875baac96a58b4fa751bccf6a2b6cc20328fb8e8570e197cd323","observation_id":"2c5d23de-30e8-4074-9bd2-2b1ad31357ad","resolution":{"observed_at":"2026-08-04T18:57:10.513658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.516542Z","title":"Strategy and skill learning for physics-based table tennis animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.516542Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:5cf90550fea787fc2cb487b9bf79826e718b750b6c1b0877479e380a81c3f70b","observation_id":"6d19cb72-ee86-4b27-930a-4ac0df85c6b4","resolution":{"observed_at":"2026-08-04T18:57:10.516542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.519610Z","title":"Reconstructing action- conditioned human-object interactions using commonsense knowledge priors","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.519610Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:e39bb2df43322bd78333b01381135241a3760a67fc8931e07a68fc819e8b66ea","observation_id":"2c0c882b-376a-4b1f-bc2c-fee634c0a7ce","resolution":{"observed_at":"2026-08-04T18:57:10.519610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04393","last_updated":"2023-12-07T16:06:31Z","snapshot_observed_at":"2026-08-20T05:06:00.838468Z","submitted_at":"2023-12-07T16:06:31Z","title":"PhysHOI: Physics-Based Imitation of Dynamic Human-Object Interaction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04393","snapshot_observed_at":"2026-08-04T18:57:10.522585Z","title":"PhysHOI: Physics-based imita- tion of dynamic human-object interaction.arXiv preprint arXiv:2312.04393, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.522585Z"},"links":{"cited_paper":"/paper/2312.04393","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:e77e48da53f98e0468e5680289ed577841d5ffc073ee64a6438fc506b4f24ed6","observation_id":"596ce76f-5dc1-4e55-a2a9-07c4153fe0cb","resolution":{"observed_at":"2026-08-04T18:57:10.522585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15270","last_updated":"2025-03-28T08:56:06Z","snapshot_observed_at":"2026-08-16T13:26:59.338002Z","submitted_at":"2024-08-12T15:19:04Z","title":"SkillMimic: Learning Basketball Interaction Skills from Demonstrations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15270","snapshot_observed_at":"2026-08-04T18:57:10.525477Z","title":"Skillmimic: Learning reusable basketball skills from demonstrations.arXiv preprint arXiv:2408.15270,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.525477Z"},"links":{"cited_paper":"/paper/2408.15270","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:a859c53b8647f757e55c3d182cdb343f777d414f45a25494f8a1ac2ebea93ee5","observation_id":"93f6fbb2-c424-44c1-aa62-28a3be37c148","resolution":{"observed_at":"2026-08-04T18:57:10.525477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15864","last_updated":"2024-11-21T03:51:58Z","snapshot_observed_at":"2026-08-19T00:42:41.766833Z","submitted_at":"2023-11-27T14:32:33Z","title":"InterControl: Zero-shot Human Interaction Generation by Controlling Every Joint","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15864","snapshot_observed_at":"2026-08-04T18:57:10.528751Z","title":"Inter- Control: Generate human motion interactions by controlling every joint.arXiv preprint arXiv:2311.15864, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.528751Z"},"links":{"cited_paper":"/paper/2311.15864","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:e70bfb5d59293aaf207b992f09aab2aa59b60f83dadd977e19c1fefdabc4aec5","observation_id":"af955355-2e84-43ef-abf7-a71bbd7660e7","resolution":{"observed_at":"2026-08-04T18:57:10.528751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.531696Z","title":"Hoh: Markerless mul- timodal human-object-human handover dataset with large object count","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.531696Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:8b90cb7bbf5705de91ab1e502df207cb53f6ae96ff4eb861f65018ec4b343b67","observation_id":"699a910a-814c-46fe-bd8c-c3306ec594f2","resolution":{"observed_at":"2026-08-04T18:57:10.531696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.534462Z","title":"Daydreamer: World models for physical robot learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.534462Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:6dbc4d3e53bc895045acdb8b9d44ffbdca582d839aabe9caf7d9cc21fb3fee04","observation_id":"97b81963-9881-4a7e-84f7-265f1c58bae5","resolution":{"observed_at":"2026-08-04T18:57:10.534462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11208","last_updated":"2024-03-17T13:17:25Z","snapshot_observed_at":"2026-08-19T21:36:26.361410Z","submitted_at":"2024-03-17T13:17:25Z","title":"THOR: Text to Human-Object Interaction Diffusion via Relation Intervention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11208","snapshot_observed_at":"2026-08-04T18:57:10.537392Z","title":"THOR: Text to human-object inter- action diffusion via relation intervention.arXiv preprint arXiv:2403.11208, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.537392Z"},"links":{"cited_paper":"/paper/2403.11208","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:875e3366e75ab400e4ecff8aa118a96894a926d7c9954bfadca4b512f02f50e5","observation_id":"b7bfc99c-09ba-4a63-bed7-874073550bb5","resolution":{"observed_at":"2026-08-04T18:57:10.537392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.540316Z","title":"SAGA: Stochastic whole- body grasping with contact","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.540316Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:194523d12dedb314b340d895d5ff0154069f5140a59474351369c2b7b42c6645","observation_id":"05885fe2-f155-4e63-b11e-b3608e762b68","resolution":{"observed_at":"2026-08-04T18:57:10.540316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17840","last_updated":"2025-08-21T08:23:55Z","snapshot_observed_at":"2026-08-18T02:06:39.510317Z","submitted_at":"2024-06-25T17:46:28Z","title":"Human-Object Interaction from Human-Level Instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17840","snapshot_observed_at":"2026-08-04T18:57:10.542988Z","title":"Human-object interaction from human-level instructions.arXiv preprint arXiv:2406.17840, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.542988Z"},"links":{"cited_paper":"/paper/2406.17840","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:596a82bd3f7cbfd38589aa0fc47f022e498081420348a7d2d0596f9c247dc3f0","observation_id":"6785d5c9-61de-4cbe-ab95-ff290af3644c","resolution":{"observed_at":"2026-08-04T18:57:10.542988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.546016Z","title":"Chore: Contact, human and object reconstruction from a single rgb image","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.546016Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:fceda7a02748c11300a6ee739e55680f857d686a78b2cb653c5814aeb9a043dc","observation_id":"22e9faf8-118d-4655-b0b3-8611581c86cc","resolution":{"observed_at":"2026-08-04T18:57:10.546016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13953","last_updated":"2024-08-25T22:26:46Z","snapshot_observed_at":"2026-08-16T13:23:57.997326Z","submitted_at":"2024-08-25T22:26:46Z","title":"InterTrack: Tracking Human Object Interaction without Object Templates","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13953","snapshot_observed_at":"2026-08-04T18:57:10.548615Z","title":"In- terTrack: Tracking human object interaction without object templates.arXiv preprint arXiv:2408.13953, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.548615Z"},"links":{"cited_paper":"/paper/2408.13953","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:55a48b795858abb7546e70252a4558b56005639fb97fc0b76de2175a886de4ca","observation_id":"6972b270-e9a8-486f-b319-1b61e85aaeb0","resolution":{"observed_at":"2026-08-04T18:57:10.548615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08580","last_updated":"2024-04-14T22:23:18Z","snapshot_observed_at":"2026-08-16T14:52:35.066513Z","submitted_at":"2023-10-12T17:59:38Z","title":"OmniControl: Control Any Joint at Any Time for Human Motion Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08580","snapshot_observed_at":"2026-08-04T18:57:10.551522Z","title":"OmniControl: Control any joint at any time for human motion generation.arXiv preprint arXiv:2310.08580, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.551522Z"},"links":{"cited_paper":"/paper/2310.08580","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:4ef0345c44409927b7c1df700a16af5c26487b1d332fe1722dbcf4beee98c09f","observation_id":"8a7d68b0-d91f-40cb-92fb-c429658b2d43","resolution":{"observed_at":"2026-08-04T18:57:10.551522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:57:10.554448Z","title":"Learning soccer juggling skills with layer- wise mixture-of-experts","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.554448Z"},"links":{"citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:b1fe3c4d8fae3185df1d52e01a8ceb1ebdefa1ed0395025428759b1f44760b2f","observation_id":"e6be3d86-3811-4d3e-a51d-5d090ef0fd08","resolution":{"observed_at":"2026-08-04T18:57:10.554448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09532","last_updated":"2023-07-08T07:22:06Z","snapshot_observed_at":"2026-08-19T13:26:19.547670Z","submitted_at":"2023-06-15T22:23:27Z","title":"Hierarchical Planning and Control for Box Loco-Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09532","snapshot_observed_at":"2026-08-04T18:57:10.556979Z","title":"Hierarchical planning and control for box loco-manipulation.arXiv preprint arXiv:2306.09532, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-04T18:57:10.556979Z"},"links":{"cited_paper":"/paper/2306.09532","citing_paper":"/paper/2509.09555"},"observation_digest":"sha256:7458c9d8ffbb48b83d0c7e2f8c4cf6a5a2667494c6e5df24613744f9e223324d","observation_id":"ea82cf21-8b9c-4bde-a1be-ccc95b691262","resolution":{"observed_at":"2026-08-04T18:57:10.556979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.09555","last_updated":"2025-09-11T15:43:54Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T05:10:24.960754Z","submitted_at":"2025-09-11T15:43:54Z","title":"InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":134},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 100 of 134 outbound references and 0 inbound Pith citation observations for arXiv:2509.09555."}