{"as_of":"2026-08-08T03:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eee46f9a1f40789bf970fc81fa8eaa8c659e904c3fe93eabf512e9c34aa8b42b","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:34:29.029262Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.24315/citation-record","integrity":"/paper/2505.24315/integrity","json":"/paper/2505.24315/citation-record.json","paper":"/paper/2505.24315"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:34:23.464217Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:23.464217Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:2739c451414e987f36c863f8e865cad596e522a00b8293a7bbf8a970558b7dc0","observation_id":"9003a705-6a19-46a8-9b1f-a5b817d3ea81","resolution":{"observed_at":"2026-08-07T12:34:23.464217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:39.238013Z","title":"Behave: Dataset and method for tracking human object in- teractions","venue":null,"work_id":"1f1c7435-2583-44cb-a134-ac38fb28619e","year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:23.572508Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:f2ea493d3d5e75a91247c1cbdf4aac6b93c0817b8632de6f2c46516af78f3d34","observation_id":"fbeb8fbc-ec17-41fe-a29a-e6fe49c839f9","resolution":{"observed_at":"2026-08-07T12:34:39.302785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:39.072235Z","title":null,"venue":null,"work_id":"9632736d-0d41-4655-9bff-205c20a732c6","year":2016},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:23.671727Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:9a200c9cb84bce95e7e08435e0ca31c83db2fee4845829d1b7efdbd17bdf566f","observation_id":"ced04d31-9aab-407c-bea2-2659ecbc4f5a","resolution":{"observed_at":"2026-08-07T12:34:39.145179Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:23.769585Z","title":"Dreamavatar: Text-and-shape guided 3d hu- man avatar generation via diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:23.769585Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:6ca74e298b17be8e66fb9f1ba5032bdb0e78365aa2a786c3546d3c698190dcc7","observation_id":"f6875bfe-107a-4879-bf09-fc4386193f2a","resolution":{"observed_at":"2026-08-07T12:34:23.769585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:38.848204Z","title":"Realtime multi-person 2d pose estimation using part affin- ity fields","venue":null,"work_id":"c19760a8-afd3-40ee-9f19-bc419ef68b44","year":2017},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:23.849556Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:e83d173e79919e4ff1f3afae102a68b4f883db9f13d2abf31857aa48758734d0","observation_id":"b9512357-b643-40fe-b224-4ade415acbce","resolution":{"observed_at":"2026-08-07T12:34:38.940621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:38.669602Z","title":"Fan- tasia3d: Disentangling geometry and appearance for high- quality text-to-3d content creation","venue":null,"work_id":"2d00fc15-826f-4e43-9170-b9eb65ea9e4d","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:23.929980Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:018de250a71f4e1d865e3802920f5ba52aae888234944cc7c4b14a66cb1eafbe","observation_id":"69564551-ef48-401d-8ba5-18ac51609ef6","resolution":{"observed_at":"2026-08-07T12:34:38.744471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:38.430395Z","title":"Comboverse: Compositional 3d as- sets creation using spatially-aware diffusion guidance","venue":null,"work_id":"9ff5cc61-c28c-4f7a-977b-62f9ad665b4f","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.055940Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:37e11e1ff946132920061a1f91dd0fac9f79973b482c61341dc36a9d89658c81","observation_id":"709043dd-7846-4631-a4df-11c7d7be4d60","resolution":{"observed_at":"2026-08-07T12:34:38.532362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:38.268283Z","title":"Syn- thesis and optimization of force closure grasps via sequential semidefinite programming.Robotics Research: Volume 1, pages 285–305, 2018","venue":null,"work_id":"5a3c9aa1-40d4-4968-853a-13b213f21e63","year":2018},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.155695Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:95f8df82718d3387c7e8578aab0e3b34fba28493b71f73fd89a74f8a63f2178a","observation_id":"4a899890-d660-45b7-8f3d-9e51dbc535c0","resolution":{"observed_at":"2026-08-07T12:34:38.348377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:38.083737Z","title":"In- terfusion: Text-driven generation of 3d human-object inter- action","venue":null,"work_id":"79471790-a9da-4cf7-98d0-4df2ab3f19af","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.252941Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:53f6eba886acb8349df80360a4b7f036df2472cf14dcf9a484de4175fd8fdcfc","observation_id":"6bcec3c4-2833-4ec2-adfd-af44ebfb947d","resolution":{"observed_at":"2026-08-07T12:34:38.174810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T12:34:24.318806Z","title":"Gemini: A family of highly capable mul- timodal models.arXiv preprint arXiv:2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.318806Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:7240df49377580ca84a8ff7543a997d22683fa87ad8cad374dec25024597ef94","observation_id":"7b8f75ec-8a81-4fe8-936e-de17f144abe1","resolution":{"observed_at":"2026-08-07T12:34:24.318806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:37.865476Z","title":"Kaolin: A pytorch library for accelerating 3d deep learning re- search.https://github.com/NVIDIAGameWorks/ kaolin, 2022","venue":null,"work_id":"7ce2445a-b963-4161-8ccf-c3b45b44c667","year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.395981Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:2844326e2a26ac052c111fd30abb73c5a9ef22ea539900bd70691d57ede54320","observation_id":"8327ebe9-5948-4b8d-b990-342f612a1ca5","resolution":{"observed_at":"2026-08-07T12:34:37.948139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:37.677208Z","title":"Graphdreamer: Compositional 3d scene synthesis from scene graphs","venue":null,"work_id":"de589f38-0a8e-4865-b9d8-91f5b6cfa856","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.491487Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:9a206073c8203456d399a18b3eb1b6e73b19a68b543fc5886735b9b6b34d0913","observation_id":"80058044-0048-4d5a-aa93-808fda86aa13","resolution":{"observed_at":"2026-08-07T12:34:37.763080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:37.501789Z","title":"Diffpose: Toward more reliable 3d pose estimation","venue":null,"work_id":"0bf9041c-2de3-4c91-be6c-b5fb5ed263e2","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.562050Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:aed3d612d9237abc1e7b7739c18d46a024dbcf1068f04b0788dd0b10c3f9eeeb","observation_id":"0a6f60c6-4fa9-4c8c-bb12-ac9c42d92596","resolution":{"observed_at":"2026-08-07T12:34:37.582689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:37.340894Z","title":"Human poseitioning system (hps): 3d human pose estimation and self-localization in large scenes from body-mounted sensors","venue":null,"work_id":"8546a099-b6f2-473e-afe7-7550158f978f","year":2021},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.628178Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:89f646a59a96502b7496f0b9d5d9befb51e9fa7d8b22e3331630194f49eccba0","observation_id":"4bd1311f-f907-4c79-bd1f-6ea03fc9f034","resolution":{"observed_at":"2026-08-07T12:34:37.430029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:37.174730Z","title":"Chorus: Learning canon- icalized 3d human-object spatial relations from unbounded synthesized images","venue":null,"work_id":"0116d523-027f-4177-ab22-1b1372308bf2","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.738435Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:34f14f4a4403b97f537c5e9dbf9f239a0cd9ac81e237ee4662bc598dc072b38e","observation_id":"795cf2df-cff1-4d9a-bd2b-2a87b7cac36c","resolution":{"observed_at":"2026-08-07T12:34:37.246804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:37.031540Z","title":null,"venue":null,"work_id":"7fb2986c-991b-436d-aa62-ba141cb24ce0","year":2019},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.807060Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:0a4f47a3371021df4985b1276ca4dda7badf0e96ffc4abc883bd5e059ef22585","observation_id":"49c3a889-1553-4787-8c4b-d654268adaf9","resolution":{"observed_at":"2026-08-07T12:34:37.102801Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.08535","last_updated":"2022-05-17T17:59:19Z","snapshot_observed_at":"2026-08-05T01:13:47.712758Z","submitted_at":"2022-05-17T17:59:19Z","title":"AvatarCLIP: Zero-Shot Text-Driven Generation and Animation of 3D Avatars","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.08535","snapshot_observed_at":"2026-08-07T12:34:24.914022Z","title":"Avatarclip: Zero-shot text- driven generation and animation of 3d avatars.arXiv preprint arXiv:2205.08535, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.914022Z"},"links":{"cited_paper":"/paper/2205.08535","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:6ad01cdf1255ce2e74e12ebbf73ec9b3f69e2015f5f17198c0277919758e647f","observation_id":"bce008d3-0ac8-4c9b-b660-b93137f4811a","resolution":{"observed_at":"2026-08-07T12:34:24.914022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:25.001524Z","title":"Gauhuman: Articu- lated gaussian splatting from monocular human videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.001524Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:732a5082fa55154f9ec06ea521f150277b05bf0a429f9da4be0b04950107ccb5","observation_id":"8e55421b-92d4-49d7-88ae-62b6d3b77c7f","resolution":{"observed_at":"2026-08-07T12:34:25.001524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.01698","last_updated":"2018-02-05T21:31:21Z","snapshot_observed_at":"2026-07-06T06:21:53.919801Z","submitted_at":"2018-02-05T21:31:21Z","title":"Robust Watertight Manifold Surface Generation Method for ShapeNet Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.01698","snapshot_observed_at":"2026-08-07T12:34:25.044332Z","title":"Robust water- tight manifold surface generation method for shapenet mod- els.arXiv preprint arXiv:1802.01698, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.044332Z"},"links":{"cited_paper":"/paper/1802.01698","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:fce533059f145f9ad18a266b84e8155686a4cbf9df28b1d24f6976fe3fab92df","observation_id":"f5cc5e40-5613-4d27-a2da-4331c5a8346a","resolution":{"observed_at":"2026-08-07T12:34:25.044332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:36.878010Z","title":"Full-body articulated human-object interaction","venue":null,"work_id":"7f0df744-d503-4714-85c5-78c5f813a8c7","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.162521Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:30183ed0c8ec886fb45521514298646722eeccbf885440d3af03d3b4fe4f4da0","observation_id":"7db2b8cb-79d3-4345-80df-4f8ea8da47f1","resolution":{"observed_at":"2026-08-07T12:34:36.949422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:36.686453Z","title":"Scaling up dynamic human-scene interaction model- ing","venue":null,"work_id":"edc5ad41-b71d-4506-8c20-dac6accc85bf","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.243063Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:96071240e912266bbe5ec04f8469eb44e180df0e550359c161445e3810347acb","observation_id":"f8ab66c7-1cb6-412b-9677-43881da28576","resolution":{"observed_at":"2026-08-07T12:34:36.772744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:36.503851Z","title":"End-to-end recovery of human shape and pose","venue":null,"work_id":"bcc8c6ea-32e6-4b9e-8f27-c18961ae9a89","year":2018},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.342077Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:1629b5e321d8e50952381d42fea14079a01cc6a59a3d1981cf11a6c49065e5c7","observation_id":"2a7f2f63-f289-4164-868d-90b18848d457","resolution":{"observed_at":"2026-08-07T12:34:36.609109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:36.297788Z","title":"Maximizing parallelism in the construc- tion of bvhs, octrees, and k-d trees","venue":null,"work_id":"97e40ca9-3271-463a-bc3e-1bf7d8c515c1","year":2012},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.439992Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:258a7c3e14fbc4558c62fbc49e888770285a2f50c915bdcd47f79cdac20e9987","observation_id":"6b977b02-fde5-4999-b7f2-800fd98f0fa0","resolution":{"observed_at":"2026-08-07T12:34:36.390008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:25.524391Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM Transactions on Graphics (TOG), 42(4):139–1, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.524391Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:3aa1ecda6b7600d1badfea39aeb906489d9979e0574ea7002c5bc97c6c4bd2d5","observation_id":"9dc19d9f-244f-4e94-b7c3-0320013d5a1c","resolution":{"observed_at":"2026-08-07T12:34:25.524391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:36.084065Z","title":"Beyond the contact: Discovering comprehensive affordance for 3d objects from pre-trained 2d diffusion models","venue":null,"work_id":"15e18305-9a4a-4c57-9bad-be000592e0b6","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.593645Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:d0ee5189be7f92680a67acff8bcd3e17b30aa1a69fb03183b56acda2b58df795","observation_id":"4ac260d9-3129-4a07-a85f-b543244d7faa","resolution":{"observed_at":"2026-08-07T12:34:36.185041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:35.913741Z","title":"Object motion guided human motion synthesis.ACM Transactions on Graphics (TOG), 42(6):1–11, 2023","venue":null,"work_id":"99a8a4c0-48e8-4169-8063-5a7bf8faf582","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.692574Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:ef5b5b6b97f77b4e89656bd11898a349134066b3a0b2fada14c72b193e4add43","observation_id":"72a64cf1-17be-446c-8bdb-3c61a24c35cb","resolution":{"observed_at":"2026-08-07T12:34:35.998263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:35.735356Z","title":"Controllable human-object interaction synthesis","venue":null,"work_id":"16b26fbf-a137-4cbd-a02a-2e7755ce7f1a","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.776254Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:038e0194fcc53cc24eed05edac9851170cb4ed6e13303624b7c9eac9e9724a46","observation_id":"927a4366-3134-4a39-ac87-bb3852214678","resolution":{"observed_at":"2026-08-07T12:34:35.811126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:35.519265Z","title":"Genzi: Zero-shot 3d human-scene in- teraction generation","venue":null,"work_id":"59908e55-4a7c-4bfe-a642-98b015db9a3e","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.843394Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:b0df713b25816343ec847819d180552acd120769ad29dc8745b4dd3425a39a73","observation_id":"f6dd91af-1d4c-454e-965c-27dc24bf7325","resolution":{"observed_at":"2026-08-07T12:34:35.622672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:35.273278Z","title":"Magic3d: High-resolution text-to-3d content creation","venue":null,"work_id":"1b75553c-5f56-42e2-a587-9466b3364278","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.896346Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:efc36965866744d90edf1be7154f54d6e185b4cece973738f4a07da80d64882a","observation_id":"b08ee8ad-6afd-4393-84a9-5182abf2839d","resolution":{"observed_at":"2026-08-07T12:34:35.415527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:35.029265Z","title":"One-stage 3d whole-body mesh recovery with component aware transformer","venue":null,"work_id":"b8ced601-1970-4101-9434-926b2dbb401b","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.957223Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:2a48ac3c56998a00e608db244552c2d93cf8686e317ead30eb8372671190e79f","observation_id":"5bfd788e-ca8e-4cf0-94a9-a9f45a1d09d7","resolution":{"observed_at":"2026-08-07T12:34:35.156869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:34.814052Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":"7158e491-885f-4cdf-bfc1-a6a60993e573","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.072859Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:6e2c31e19ef438f7a6023a20237cc782f40251eca7c3741152024936a3d07009","observation_id":"9f0e10d9-2069-4ef3-967f-b39b0b46b0e8","resolution":{"observed_at":"2026-08-07T12:34:34.930045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:34.627001Z","title":null,"venue":null,"work_id":"c0802c20-9ca6-40b5-8215-8f84a2af8880","year":2021},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.142139Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:ee0949c17548c52ec7c4c847754ea86ad9bbf95d624651464788388457d402bd","observation_id":"467361ea-d0b6-48c4-906a-842e0094b158","resolution":{"observed_at":"2026-08-07T12:34:34.708594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:34.439770Z","title":"Humangaus- sian: Text-driven 3d human generation with gaussian splat- ting","venue":null,"work_id":"412bfa26-89f9-42bd-8bbe-f4c60d6c7310","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.217644Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:0a190d92c332922b39a90ac61206739e530f776bf187215b62a71840dde2d307","observation_id":"173a8ea6-4fa7-4a1c-adf5-6b0c3e2d8969","resolution":{"observed_at":"2026-08-07T12:34:34.521110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:34.246611Z","title":"Syncdreamer: Gen- erating multiview-consistent images from a single-view im- age","venue":null,"work_id":"20a2d424-7d0f-4244-adc0-3c9d875c126f","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.277707Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:31e7f40ceb8c5ac87daad3b48b44d011f6abf64855d2d6017ad102ad820b801d","observation_id":"35ee2432-4d80-4690-90b7-76984fdce682","resolution":{"observed_at":"2026-08-07T12:34:34.346097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:34.006950Z","title":"Wonder3d: Sin- gle image to 3d using cross-domain diffusion","venue":null,"work_id":"6fba1bdc-6d61-47e5-802e-b93e85ba0888","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.348702Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:7341c14a5c7e1eab1327d952af8c69969b01f36bf8bc27339a8d4a8a23491ad0","observation_id":"b648f298-68cc-414d-9d0c-c5218115331c","resolution":{"observed_at":"2026-08-07T12:34:34.167011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:33.690919Z","title":null,"venue":null,"work_id":"4dbfc300-7e94-41fb-9041-23b84f6df6f8","year":2015},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.427830Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:b032e272daed60840febc3a7dce48dfaeb759659daa1bcec0a329396bc7f055a","observation_id":"5ce9d57b-9af1-41ec-b181-585319ec9bf7","resolution":{"observed_at":"2026-08-07T12:34:33.843072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:33.473260Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":"907a293d-547c-4519-870c-7aa31f3aa450","year":2020},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.486985Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:be6947ad27975a5746d00245daa1689068e63ed09c51a7cf551b592ec29ca42f","observation_id":"fb42e9ff-81b4-4ecc-95e7-43a5434e066e","resolution":{"observed_at":"2026-08-07T12:34:33.585278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:33.189993Z","title":"Partnet: A large- scale benchmark for fine-grained and hierarchical part-level 3d object understanding","venue":null,"work_id":"b37f5d0e-2060-4694-a983-85be3e647ddb","year":2019},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.540017Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:daa41f4093f787669aa3cb9a24ae2232fcd514ecdebd43458d00a53f3f0b1944","observation_id":"bd7231b9-363b-45c6-83f8-a85d591a9df7","resolution":{"observed_at":"2026-08-07T12:34:33.321464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:32.883918Z","title":"Gpt-3.5.https://platform.openai.com/ docs/models/gpt-3-5, 2023","venue":null,"work_id":"0cb03949-c7b3-483f-851b-8ad4b8111e26","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.597222Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:b8d4531b020de29bade927387f2c5bfc9bd14ff7a55f5f3318cf7fdf6e9b81f3","observation_id":"6599f09f-20bc-4d42-9613-8f9be9e1fa32","resolution":{"observed_at":"2026-08-07T12:34:33.054336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:32.568183Z","title":null,"venue":null,"work_id":"5f165e60-44b6-4fe2-a038-5e555b188707","year":2019},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.652209Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:a4487faf6ee9cfead32ac7638cd1b7e77ad54e5177eae771760e5df3f566b5f3","observation_id":"f9ba76f1-5aa6-4722-9beb-8835a61a42f1","resolution":{"observed_at":"2026-08-07T12:34:32.728798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06553","last_updated":"2025-07-07T05:09:32Z","snapshot_observed_at":"2026-08-06T14:47:15.286683Z","submitted_at":"2023-12-11T17:41:17Z","title":"HOI-Diff: Text-Driven Synthesis of 3D Human-Object Interactions using Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06553","snapshot_observed_at":"2026-08-07T12:34:26.726400Z","title":"Hoi-diff: Text-driven synthe- sis of 3d human-object interactions using diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.726400Z"},"links":{"cited_paper":"/paper/2312.06553","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:71e29050e5ec4e0651abe83ce08ddc9df256386b069740b2b9f16bb525cc43a3","observation_id":"0046c9ea-27db-42b8-b70d-bddd04d9cdc0","resolution":{"observed_at":"2026-08-07T12:34:26.726400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T12:34:26.782337Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis.arXiv preprint arXiv:2307.01952, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.782337Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:ffa6f3a3dc01effe79aa91768dda1035dee22b849ef5fc33ce5c3d6fb9c2ca89","observation_id":"b7f677aa-bec7-4101-93a0-1ce9326cef0c","resolution":{"observed_at":"2026-08-07T12:34:26.782337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:32.450542Z","title":"Dreamfusion: Text-to-3d using 2d diffusion","venue":null,"work_id":"877258cd-9248-4408-9a7b-77c87aec7ee1","year":null},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.834879Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:0b2f39b5debf5bc5089d8cbe8a3179cc0729bcfd3abe50216fde7812301928ad","observation_id":"2eb95b75-d44d-4702-8a8c-1049e1538ac9","resolution":{"observed_at":"2026-08-07T12:34:32.512312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:32.290061Z","title":"Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sastry, Askell Amanda, Pamela Mishkin, Jack Clark, Gretchen Krueger, and Ilya Sutskever","venue":null,"work_id":"d52fb900-3bf7-465c-a21e-a2f03d5c9268","year":2021},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.907187Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:268fe6da3b9433ee19f6fd84ee92f75c7e5f3e1c0a9af80232bde23aaf0b0438","observation_id":"97f3db08-eb09-4785-8fe3-50733e01d324","resolution":{"observed_at":"2026-08-07T12:34:32.367270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-07T12:34:26.977185Z","title":"Hierarchical text-conditional image gen- eration with clip latents.arXiv preprint arXiv:2204.06125,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.977185Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:04592461496af154b1ec3f536fcdd5fca9787fc2e261aef51aed5ee8fd6ee0cf","observation_id":"57ae142d-85f4-4d6b-b2cf-6cf438683c7e","resolution":{"observed_at":"2026-08-07T12:34:26.977185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:32.117964Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"22ae3356-a828-4c7c-8b61-7a7eff45ba4e","year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.049387Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:6eef6d131a18997eae6b37db1e1a405931b366f67fccb84aa0de8214063e5f70","observation_id":"5e1f11c6-49ce-4666-906e-0a370e7b2638","resolution":{"observed_at":"2026-08-07T12:34:32.209624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:27.119841Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.119841Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:57ab65e3e6857ef000dd874978ca2d3d37130107d37f618e4f1e4ceea184ee38","observation_id":"b2e38205-b5c1-4d76-b95b-613b2dfdbb7b","resolution":{"observed_at":"2026-08-07T12:34:27.119841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:31.886777Z","title":"Em- bodied hands: modeling and capturing hands and bodies to- gether.ACM Transactions on Graphics (TOG), 36(6):1–17,","venue":null,"work_id":"d1df4aec-e02a-406b-b960-eef43413c147","year":null},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.163777Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:dd02758c2263562185d72b9f4df854d569fcbfd70041c09c9d03ad62215ed26e","observation_id":"269fa7aa-d000-4dbe-9b5e-d375de924f65","resolution":{"observed_at":"2026-08-07T12:34:32.024914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:31.712344Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"dffad0f0-2694-4b25-bbfe-532515705c7b","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.195627Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:e8d58f16021de765fee1decdd7c2da55c1777f40fe31eb7c3d9334e2585c9ab6","observation_id":"b28c8125-fcc9-4bb9-837e-9387b3c44f3f","resolution":{"observed_at":"2026-08-07T12:34:31.805285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:27.341450Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.341450Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:da5cf2c3ae30e4e1c197201071b5b6c269b19a3843e304db51ce76bff58acf92","observation_id":"9fbd90b6-7a4b-421f-94f6-4e987de201c3","resolution":{"observed_at":"2026-08-07T12:34:27.341450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15110","last_updated":"2023-10-23T17:18:59Z","snapshot_observed_at":"2026-07-06T16:37:19.963994Z","submitted_at":"2023-10-23T17:18:59Z","title":"Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15110","snapshot_observed_at":"2026-08-07T12:34:27.452697Z","title":"Zero123++: a single image to consistent multi-view dif- fusion base model.arXiv preprint arXiv:2310.15110, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.452697Z"},"links":{"cited_paper":"/paper/2310.15110","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:3577c1f74e0fa47aee0c1875b1d44de542c76be12ea8ddcd27c43b07effe042c","observation_id":"8486b070-3a80-4faf-9deb-c566fb2e561e","resolution":{"observed_at":"2026-08-07T12:34:27.452697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-07-06T16:12:38.269310Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-07T12:34:27.602865Z","title":"Mvdream: Multi-view diffusion for 3d gen- eration.arXiv preprint arXiv:2308.16512, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.602865Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:1bb8d1fd379ffafdc18843f942fb0062316a397f4cc31e1e65a51faf49c72fd6","observation_id":"b9491dfe-a3c9-402a-b6e3-5f49c86cb9f2","resolution":{"observed_at":"2026-08-07T12:34:27.602865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:31.479953Z","title":"Grab: A dataset of whole-body human grasp- ing of objects","venue":null,"work_id":"bba0dea4-28be-4206-90cd-690eea6a35b2","year":2020},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.768966Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:5ea5d7d1c71aa5a4c87a907356ef7be340acf94cd5485c76963133c462d439e8","observation_id":"2b8f938f-af8b-4b38-a23c-9cc77089cb9b","resolution":{"observed_at":"2026-08-07T12:34:31.585735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:31.273284Z","title":"Deco: Dense estimation of 3d human-scene contact in the wild","venue":null,"work_id":"c8d176f6-baf0-43df-983c-250dd04f7a7b","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.884374Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:0d7c0a660b2fb0454c5e3a2ab023789c82792b82096b6294c06bb2f7ae37f7eb","observation_id":"fe2ab362-6919-4c58-a9c0-48cfeaaa4520","resolution":{"observed_at":"2026-08-07T12:34:31.365989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:31.056085Z","title":"Reconstructing action- conditioned human-object interactions using commonsense knowledge priors","venue":null,"work_id":"30cf91b7-fa14-47b6-8fec-9f2a42d2dedf","year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.017100Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:8fefc7f9c4704cbc52ac83c6293e86347b10cd30c7f3fd600de11e526e71e57e","observation_id":"84a2b3ca-f727-45a8-8493-5ed17b81d512","resolution":{"observed_at":"2026-08-07T12:34:31.174759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:30.895438Z","title":"Prolificdreamer: High-fidelity and diverse text-to-3d generation with variational score distilla- tion","venue":null,"work_id":"8b99b5e9-5ba8-4f6f-acc9-c310bac31156","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.082526Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:c9a4f9c625333e0e7c9dd995d334ff2aa10574854569daf95c22eb615185c771","observation_id":"b1fcb357-2409-466d-a9fe-5edfb4387425","resolution":{"observed_at":"2026-08-07T12:34:30.960475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:30.689660Z","title":"Srinivasan, Jonathan T","venue":null,"work_id":"50134bb8-0c9c-412b-92b4-4c2a25f3d454","year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.169610Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:94ae2eeb3d0c956055f375b213b1b3ab6980d3115275d1d8dd25cd15cb6c5c72","observation_id":"afe0f078-1466-4864-924c-163e3339cc7e","resolution":{"observed_at":"2026-08-07T12:34:30.801500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:30.487733Z","title":"InterDiff: Generating 3d human-object interactions with physics-informed diffusion","venue":null,"work_id":"1741cee6-5e69-4bdb-91e2-2c0c44945474","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.258850Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:9f9983251dbbd48feccbac73ac1da6474a84643d79649c654137297b0b8d4e65","observation_id":"587b5ae1-8250-4907-af46-655f05e25e3a","resolution":{"observed_at":"2026-08-07T12:34:30.570897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:30.344511Z","title":"Inter- dreamer: Zero-shot text to 3d dynamic human-object inter- action.Advances in Neural Information Processing Systems, 37:52858–52890, 2024","venue":null,"work_id":"317aa923-3c69-44a0-b5dd-9589fd662acf","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.348072Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:3143a777131a9572871d74a7d71e5ba492e060f75d7703e9d1527d2391b8411c","observation_id":"a47186b5-86ad-4e1c-a459-0cae0765b661","resolution":{"observed_at":"2026-08-07T12:34:30.407736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:30.178312Z","title":"Generating human interaction motions in scenes with text control","venue":null,"work_id":"e54cccac-514d-414a-993c-f7769457c3a4","year":2025},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.436864Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:0de8e6fb358087b10e2b12d6d37b389a04deae23f1fd8e719494b7ae895ec3dc","observation_id":"ac0d31af-10aa-4bd3-b25d-b99ebcf4f78d","resolution":{"observed_at":"2026-08-07T12:34:30.258402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:30.037255Z","title":"Whac: World-grounded hu- mans and cameras","venue":null,"work_id":"c4913a37-e175-4858-b1f4-ab8aaf22545b","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.526428Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:74e038e4144ca374a54d4b94c8d03740f7472dbce880fd4818f18515bddf45a0","observation_id":"710b7347-e420-4c29-be77-3c537a0bd735","resolution":{"observed_at":"2026-08-07T12:34:30.101571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:29.926186Z","title":"Pymaf-x: To- wards well-aligned full-body model regression from monoc- ular images.IEEE Transactions on Pattern Analysis and Ma- chine Intelligence, 45:12287–12303, 2023","venue":null,"work_id":"ff8da1ce-c765-4630-8329-324dbb5aa53e","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.616790Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:20f591227503283192ede3a6867ba90b8b5152175e27ab7cfcd62ba63efbcdd5","observation_id":"b0afaa77-f5aa-4018-a077-eaa6d79be4b8","resolution":{"observed_at":"2026-08-07T12:34:29.987265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:29.739825Z","title":"Mixste: Seq2seq mixed spatio-temporal encoder for 3d human pose estimation in video","venue":null,"work_id":"91e029db-a5b0-4043-bdbc-78c911012a9b","year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.708144Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:03b7d0a6f6b1577e67aa221f14f197a04aa6751d5b20b01aacc9aa3b3e654a2e","observation_id":"40014f15-d665-4c88-8bb5-31ba1f88acf0","resolution":{"observed_at":"2026-08-07T12:34:29.823834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:29.595596Z","title":"Zhang, Sam Pepose, Hanbyul Joo, Deva Ra- manan, Jitendra Malik, and Angjoo Kanazawa","venue":null,"work_id":"70665718-0ffc-4946-b7d7-0c7b59fe1500","year":2020},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.796048Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:19cab07ae5c34b726a6523479d873819bd1375d044284a3a6f1d21371b42b2d8","observation_id":"6849bd03-f493-4da2-a4df-71ec36508100","resolution":{"observed_at":"2026-08-07T12:34:29.657900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:29.443619Z","title":"Humannerf: Efficiently gen- erated human radiance field from sparse inputs","venue":null,"work_id":"dd1a5f91-bdfe-4521-b8e1-06fca1f47889","year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.886355Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:a88e7c0b6f5caf39272593d061cccd022886a009202a0b063f7718181b8c0df5","observation_id":"2138a9dd-6f82-4e15-a8dc-062ead5f4573","resolution":{"observed_at":"2026-08-07T12:34:29.503854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:29.298103Z","title":null,"venue":null,"work_id":"745b52da-a7dc-4511-aace-236d0e8405d6","year":2021},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.952591Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:3dcd57f346d0a6c8675b8a420e1b7f59988f0412e60d44f0f12e099c6ffeaf5b","observation_id":"e50db607-bbad-4cac-a0c6-08cc28e3d6ff","resolution":{"observed_at":"2026-08-07T12:34:29.351635Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08278","last_updated":"2024-09-12T17:59:49Z","snapshot_observed_at":"2026-07-06T19:14:33.669810Z","submitted_at":"2024-09-12T17:59:49Z","title":"DreamHOI: Subject-Driven Generation of 3D Human-Object Interactions with Diffusion Priors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08278","snapshot_observed_at":"2026-08-07T12:34:29.029262Z","title":"Dreamhoi: Subject-driven generation of 3d human- object interactions with diffusion priors.arXiv preprint arXiv:2409.08278, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:29.029262Z"},"links":{"cited_paper":"/paper/2409.08278","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:875da7863bf24578753a03d957209a119b8439dc2c9384edde6cedb22eabbacd","observation_id":"525fa60a-83ae-4851-bc7e-07f822574b16","resolution":{"observed_at":"2026-08-07T12:34:29.029262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T14:19:59.725331Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":46},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2505.24315."}