{"as_of":"2026-08-07T05:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5b2970c88d1d170128d295194b08acd49eeadadd1b38a63a615b8aa8bf7e36c6","coverage":[{"denominator":90,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":90,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T21:11:31.022938Z","state":"measured"},{"denominator":93,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":93,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T21:27:31.480422Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-01T15:45:48.672572Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"cited_work":{"arxiv_id":"2603.20850","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.20850","snapshot_observed_at":"2026-07-01T15:45:48.672572Z","title":"Glove2hand: Synthesizing natural hand-object interaction from multi-modal sensing gloves","venue":"cs.CV","work_id":"09283f99-568d-4aae-ab5d-2ec611d2f4b6","year":2026},"citing_paper":{"arxiv_id":"2605.21714","last_updated":"2026-05-20T20:19:24Z","snapshot_observed_at":"2026-08-01T06:35:49.036114Z","submitted_at":"2026-05-20T20:19:24Z","title":"AVI-HT: Adaptive Vision-IMU Fusion for 3D Hand Tracking","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T09:05:21.364595Z"},"links":{"cited_paper":"/paper/2603.20850","citing_paper":"/paper/2605.21714"},"observation_digest":"sha256:6d589fb25a083c39371006504d71d9c65039bc085289fae28ad504ca941caf8d","observation_id":"14fb8ebf-e72d-480a-a1e0-3d092fc919a9","resolution":{"observed_at":"2026-06-10T02:10:36.233618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"cited_work":{"arxiv_id":"2603.20850","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.20850","snapshot_observed_at":"2026-07-01T15:45:48.672572Z","title":"Glove2hand: Synthesizing natural hand-object interaction from multi-modal sensing gloves","venue":"cs.CV","work_id":"09283f99-568d-4aae-ab5d-2ec611d2f4b6","year":2026},"citing_paper":{"arxiv_id":"2605.24934","last_updated":"2026-05-28T10:10:45Z","snapshot_observed_at":"2026-07-06T23:34:57.148983Z","submitted_at":"2026-05-24T08:26:41Z","title":"HumanEgo: Zero-Shot Robot Learning from Minutes of Human Egocentric Videos","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-30T01:02:58.035784Z"},"links":{"cited_paper":"/paper/2603.20850","citing_paper":"/paper/2605.24934"},"observation_digest":"sha256:dc3aa09962cfc56b91f9e7d1387b03b4fb6a9150aa56daddf4fb905773b1afad","observation_id":"8cded10c-1259-42dd-b0e9-adbe19088f1e","resolution":{"observed_at":"2026-07-01T15:45:48.673819Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.20850","snapshot_observed_at":"2026-07-30T21:27:31.480422Z","title":"Zhang, Z","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23473","last_updated":"2026-07-26T05:58:10Z","snapshot_observed_at":"2026-08-05T09:13:18.038036Z","submitted_at":"2026-07-26T05:58:10Z","title":"PRISM: Polynomial Representations for Interaction-Structured Motor Control","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-30T21:27:31.480422Z"},"links":{"cited_paper":"/paper/2603.20850","citing_paper":"/paper/2607.23473"},"observation_digest":"sha256:b313c81ae691151bc79634181210e76351e465f260ca24a490eff6ecd8113721","observation_id":"a3beba1b-9885-482f-997b-9afddb9dfb65","resolution":{"observed_at":"2026-07-30T21:27:31.480422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2603.20850/citation-record","integrity":"/paper/2603.20850/integrity","json":"/paper/2603.20850/citation-record.json","paper":"/paper/2603.20850"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"sensel morph haptic sensing tablet","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:2dc076d7e9675f622e7f2c1616ac10f178f3d3a349e4d923520bf802f24dd02a","observation_id":"08f4f612-49a0-4150-b341-5e441eb9d2e0","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Hot3d: Hand and object tracking in 3d from egocentric multi-view videos","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:2e8964fca667c456757d63270bc1cc6058828a80dd2843f5e09003b01d8ee568","observation_id":"7c4ffa73-1fe7-4366-a692-1847d7bdf867","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Videopainter: Any- length video inpainting and editing with plug-and-play con- text control","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:599fc6853438531c75fc560b0cc30c42f4c435fad3052e35fa31f535babf6fcf","observation_id":"11aeabe1-e20f-4f10-9997-dc550294e125","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Contactpose: A dataset of grasps with object contact and hand pose","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:6eb5df6c9395e6b753ccaa4f0a49bb42475de0601f66123fa8b207f317c672d8","observation_id":"f4429654-d93f-4f03-b91b-6c442692982a","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"A realistic radar ray tracing simulator for hand pose imaging","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:3bee862d655ac21089e3b41cce34b0c670d268a007797b9e1a48cc02c8f07758","observation_id":"012eb4c4-09a9-4fe9-8721-d4657610a192","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Hand-object interaction: From human demon- strations to robot manipulation.Frontiers in Robotics and AI, 8:714023, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:5ed78e6246dc27219226de5340077930f2fa397019df8fba904156c9129ed4b6","observation_id":"523d2346-c0db-42ba-af71-100c8523c3b3","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Dexycb: A benchmark for capturing hand grasping of objects","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:7079b60b03d10f7b889cb718149c389172dfea07bca6169503a34123d5a59b90","observation_id":"e0f31f63-0ceb-4235-a137-d94ad8449d04","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Foundhand: Large- scale domain-specific learning for controllable hand image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:4ca85bdefdc5634f672b90231a2982e1ad46733daf4b3898a53cf144c786dd3b","observation_id":"3641a3fe-585c-45ab-b790-a3682f42532d","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Hand avatar: Free-pose hand animation and rendering from monocular video","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:f88d93740e35dccef0c786214a9c53bdadb0f8eb90157ef859933d5894a56fe5","observation_id":"dd32381b-2efc-4ba4-8aa1-216d5fe967ed","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Medm: Mediating image diffusion models for video- to-video translation with temporal correspondence guidance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:28f4a39640e30396ceaf88be75381de15bd5c30e712c06579d1c2ac78e040929","observation_id":"4bd7128d-b43a-458b-bd52-2dc048c0700b","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Handsplat: Embedding-driven gaussian splatting for high-fidelity hand rendering.arXiv preprint arXiv:2503.14736","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:2439a76f6b9e9847979d95a7e3893cb65df946de26b07d13459b7871fbd5f29d","observation_id":"e198dbfd-71a7-47e2-a97a-88d66e52623c","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Arctic: A dataset for dexterous bimanual hand- object manipulation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:fd0ed906c0f839c017633b401c52dcae147a30eee25ef6b9050c3e817e9faa84","observation_id":"2f2b82da-7c51-4bee-9e6f-25c12663ae7c","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"On the content bias in fr ´echet video distance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:e35b7227282c02129529f253c6859a2beba75bd07874f765da6f6b7217d674ce","observation_id":"59af3180-7768-438b-af52-6b89cac43484","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Pressurevision++: Estimating fingertip pressure from diverse rgb images","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:9a0ae4da271119c50bcdaf819b1cd13bca48f79fab3b5dae6e52526ce6b0dad8","observation_id":"fbaea8a6-ccae-4827-b40d-ecf80c1f843a","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Pressurevision: estimating hand pressure from a single rgb image","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:cf1fda3a27f38285548c775a786461b5456898766e54f1d31878cd19271bfbb5","observation_id":"abdafe14-c0a5-4bd3-8f7c-30c6c85ff372","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Ego4d: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:1767931e881d73ccc072ea43a06b9fa57b28d1ec497a117668dfa793d37651e2","observation_id":"fa57d8ee-fe1a-4a04-8552-f69d3c24251f","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Elsevier, 2011","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:158765031236aa2ff7a19b8845a4b07abc544173f55c90980d0105a34a54c49d","observation_id":"6f35741b-c87c-45a5-bb4a-aa4300a5de22","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00857","last_updated":"2025-03-11T13:13:11Z","snapshot_observed_at":"2026-08-05T12:04:12.526165Z","submitted_at":"2024-12-01T15:45:26Z","title":"Coherent Video Inpainting Using Optical Flow-Guided Efficient Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00857","snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Coherent video inpainting using optical flow-guided efficient diffusion.arXiv preprint arXiv:2412.00857, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"cited_paper":"/paper/2412.00857","citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:087e7a80e42085edaf02ae21ceb63db78a409acb40241320c1e7fd16ad131075","observation_id":"0989075d-349f-4b75-8798-25b8ee7ebfcd","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"From human-computer inter- action to human-robot manipulation.Engineering Proceed- ings, 110(1):1, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:967aad5967eec36edd703cb0bb29dcbffdb65f857bb2b48b6d614bfd36b2d2c0","observation_id":"17ef3484-cbae-4f5d-b654-6dc6ac72fcbb","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:4c02ffcf626deee6a5c917dfb03c0a60c6f7d6238bf412c25cec5f3230c9c607","observation_id":"68e59b20-5b6a-4e41-a892-e8b51821b026","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Honnotate: A method for 3d annotation of hand and object poses","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:1fe2d030af938edd9772904b36e6bab4a7500e0981eaebed14eb251b5529bb6f","observation_id":"f3e166af-9328-4c30-ad9b-a045de955540","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Umetrack: Unified multi- view end-to-end hand tracking for vr","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:9f51c0ff4b06d2617f165675f2d86e08d22e98a9aa786edf477998e4fc3fd32b","observation_id":"03f0757f-a2de-4c43-a530-21d124e66c79","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Mul- timodal hand gesture recognition based on the fusion of sur- face electromyography and vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:0f04ea843c0ed0e67f047fe597b499557f9ab933181c2d2c7f43f80049ffcbbe","observation_id":"04f34b28-67c2-4681-8d4a-d968990ba946","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Hand gesture recog- nition for human computer interaction.Procedia computer science, 115:367–374, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:0aa7d7e045a2c6ae9fc79648b4e954eae6806e0cd0e387501977b435d5517b41","observation_id":"06cbc50c-45d2-451c-8213-eb3f76f728ee","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:eb39c0f8f3786fbe1a6acb83ab0cbd63f708e9877fa698fad12d5a9a82e4720a","observation_id":"ed18d440-1b3f-475a-a199-c0dc174dad78","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11709","last_updated":"2026-03-09T06:44:42Z","snapshot_observed_at":"2026-07-06T21:25:23.371749Z","submitted_at":"2025-05-16T21:34:47Z","title":"EgoDex: Learning Dexterous Manipulation from Large-Scale Egocentric Video","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11709","snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Egodex: Learning dexterous manip- ulation from large-scale egocentric video.arXiv preprint arXiv:2505.11709, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"cited_paper":"/paper/2505.11709","citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:c28d2a7bbbd107e2924a965bfcbc8526628354f19c29d2cf7e487fbfda1b078d","observation_id":"087c3602-1f59-401e-9722-064e5806463f","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Lora: Low-rank adaptation of large language models.ICLR, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:e4a89f81473a826edcbda393badb7ef486d7730a1fb9ac1f9e105525c6b42106","observation_id":"a080e2b1-9b4a-478c-95af-f0139684b6af","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.14073","last_updated":"2023-08-03T09:34:24Z","snapshot_observed_at":"2026-07-06T15:58:43.241452Z","submitted_at":"2023-07-26T09:50:44Z","title":"VideoControlNet: A Motion-Guided Video-to-Video Translation Framework by Using Diffusion Model with ControlNet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.14073","snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Videocontrolnet: A motion-guided video-to-video translation framework by using diffusion model with controlnet.arXiv preprint arXiv:2307.14073","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"cited_paper":"/paper/2307.14073","citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:c2a7f11293dd4bd44b2c630809763b96ebca79e63abfba5da0dbec36298889a3","observation_id":"4f591d36-9357-4ee0-873d-3720ff34e590","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"2d gaussian splatting for geometrically ac- curate radiance fields","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:9fd027791b323a69e568813f7fed5be4d9b94311678f4a839db4091a9e7abadc","observation_id":"b237552b-ad77-46a8-b660-2d5301054dc4","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Hoigpt: Learning long- sequence hand-object interaction with language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:0bcc27a22e25460977fd8fb21a1122a71ee7a41a769bee739287c91c453f0ab1","observation_id":"509deb30-96d8-427c-af0c-48e08f49f0a4","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Image-to-image translation with conditional adver- sarial networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:540c5fb1fa72461f44d8fa806431b4dcc2c76fa3ce25fc159015a04358e13c6c","observation_id":"faf389bd-ebb8-462d-b3a0-43f18d46f4bc","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Re- lightablehands: Efficient neural relighting of articulated hand models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:e29fba765e06a9fb83192412773eb95d58b56b86c676e0d37c27c8aa71225807","observation_id":"f63c54c0-3b42-44a9-8f5a-9b2e99016318","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05231","last_updated":"2025-06-03T00:07:34Z","snapshot_observed_at":"2026-07-06T20:48:22.689787Z","submitted_at":"2025-03-07T08:28:24Z","title":"Kaiwu: A Multimodal Manipulation Dataset and Framework for Robot Learning and Human-Robot Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05231","snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Kaiwu: A multimodal manipu- lation dataset and framework for robot learning and human- robot interaction.arXiv preprint arXiv:2503.05231, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"cited_paper":"/paper/2503.05231","citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:5dc40606c37244ded62b4c3179631ca66145b60f278c3e4369f1b212c08d5bf0","observation_id":"9d48e988-08ba-4679-adf0-dbae28be299b","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Brushnet: A plug-and-play image inpainting model with decomposed dual-branch diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:6974c9a78481d41fbc5c2c7d37876171cd213ed605c837dc55e33931a9244e4e","observation_id":"57f91193-3728-411b-b0d2-7ef75eb62512","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Lumigauss: Relightable gaussian splatting in the wild","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:e70378b27df9ae8cb199c43b47b6a1308edaa75db507a4d6545b4551c5ba920e","observation_id":"54fdf170-d83d-4002-a3c5-dae657725872","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Harp: Personalized hand reconstruction from a monocular rgb video","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:d13a3b58e61e1a121dafaab623fa04211979089e0e512790ec8d198bfae56f17","observation_id":"5057318d-06ab-4671-b3ab-ae7399752706","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM Trans","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:bd623a13643d7819d5e2c946b419a0233911f43b14e061b8f7840b4d4aa64d3c","observation_id":"c2f2c9e5-c1fe-49bd-bd6d-8a9db39c0d42","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"H2o: Two hands manipulating objects for first person interaction recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:3fc28ae918746b4b8fb75f62f27db86ee1b7a27b59f2752b876e68ce01fa4887","observation_id":"14c22776-2fc3-48f6-b06d-ef0c1f519cea","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10018","last_updated":"2025-01-17T08:03:02Z","snapshot_observed_at":"2026-08-06T16:39:48.582832Z","submitted_at":"2025-01-17T08:03:02Z","title":"DiffuEraser: A Diffusion Model for Video Inpainting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10018","snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Dif- fueraser: A diffusion model for video inpainting.arXiv preprint arXiv:2501.10018, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"cited_paper":"/paper/2501.10018","citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:e5613b8c90fa68ee4cb72f392d3a39c5ef7132a6afdd37bc96f4217e446f1a69","observation_id":"6afc7dd6-7b40-4e09-be21-aa0f45f815ca","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Fsglove: An inertial-based hand track- ing system with shape-aware calibration.arXiv preprint arXiv:2509.21242, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:855c34f1fb3ead50eee4c821a34628f076b2adff5b122ad2162518dbbc3f0b47","observation_id":"9a5c9d4d-cf98-4c69-9d8a-a7846d7d5be6","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:f2ef3878b92b23240a858fd44d3e36e53e7db0fc9ee8ddf4a2b57c16c673626d","observation_id":"05265d02-f086-4e3b-9a52-ba93bfa37000","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Hoi4d: A 4d egocentric dataset for category-level human- object interaction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:cd098bd7cbfbe8ef3025f2ac852636a0c17dc1a162c37a5421c4a454c90ab3ec","observation_id":"40ebf148-76e7-4f71-8a94-68e90479735b","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Handrefiner: Refining malformed hands in generated images by diffusion-based conditional inpainting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:f3ef414d714afce96466d493d941b541a2d5dbb849dde6d674be39ba014b0a8f","observation_id":"cbef9da6-bc06-4913-8b3d-07ac246d13e0","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15597","last_updated":"2025-07-21T13:19:09Z","snapshot_observed_at":"2026-08-06T15:25:42.125132Z","submitted_at":"2025-07-21T13:19:09Z","title":"Being-H0: Vision-Language-Action Pretraining from Large-Scale Human Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15597","snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Being-h0: Vision-language-action pre- training from large-scale human videos.arXiv preprint arXiv:2507.15597, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"cited_paper":"/paper/2507.15597","citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:6b1c93cd11536361f9ce2954c79dd2740209d676ba436454702a091fb058047b","observation_id":"995409de-51e6-4c60-8313-a0d448e7afc8","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Adaptive tactile interaction transfer via digitally embroidered smart gloves.Nature com- munications, 15(1):868, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:5fc02100e6b1cc45ce801bd428df7056192d7f753825a434c37cfeb98d0a7d56","observation_id":"473b9218-d70b-4754-9a97-9654f121a3bc","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Diff-ip2d: Diffusion-based hand-object interaction predic- tion on egocentric videos.arXiv preprint arXiv:2405.04370,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:925e004801f43219eb58b81d3842933e46a269cfc81e30e46cebe599d7f38dba","observation_id":"70a3944a-1007-4a3f-8ee8-a25d90368635","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Enhancing hand-object interactions in virtual reality for precision manual tasks.Virtual Reality, 28(4):166, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:2f4649507c62ccafe8aa782a8a68cb17039c0a2482afdfc4e5e4fba1db63149e","observation_id":"aa6309a4-1ba1-4c1a-876e-63d4622a9797","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Nerf: 10 Representing scenes as neural radiance fields for view syn- thesis.Communications of the ACM, 65(1):99–106, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:6b424d6d51ee999edf7accc5d1dc99e58a05a85d04d847b9202ed038b123a226","observation_id":"28769e80-8d6b-4a56-9e2e-4c5017384374","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Interhand2","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:393e0bf16f94ab9b485670b51320e45eeeaf935fe00c4db91214d60550c75139","observation_id":"05719e01-db5d-4add-8974-6b294bcb0c1f","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Livehand: Real-time and photorealistic neural hand rendering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:aabd31c7a4dc4e85dbb6689e6c1a96f8f6b6f0ff4c026b40d545db30980f2256","observation_id":"bd15fdc2-c38d-4462-a8ec-39d108446683","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Hand- iffuser: Text-to-image generation with realistic hand appear- ances","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:9fd9b8bd4c257b9d51c3da2389a265ee1255865bd600e587fcb178ff47850e70","observation_id":"87738122-da55-44d9-b2bf-f7caf6bddec9","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Attention- hand: Text-driven controllable hand image generation for 3d hand reconstruction in the wild","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:f9f41398351bd786898e14072a8cc666d8c7ce77edcd56bbb5df7850e285755d","observation_id":"00069fea-c234-4155-a35f-583f2a33a267","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"On aliased resizing and surprising subtleties in gan evaluation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:98127fada41b6cd9212ce69de32ec421e6f40b7c8eee8b9ad642920783ac4600","observation_id":"2f4e4291-5bf3-4c83-ae3b-c2d1d98e5d76","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Giving a hand to diffusion models: a two-stage ap- proach to improving conditional human image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:2feb91e5646f98637ad7518a347c7629ee6488fc8c667ad1364ffdcdb8bee6f6","observation_id":"11ce23b3-0dc4-4261-b126-18cacbdaa8f7","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Sam 2: Segment anything in images and videos.arXiv preprint arXiv:2408.00714, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:55c8fc689e1b10880dd500aea1bcdf41c83c0bfbc0fdb9bd84565c8c70a6f507","observation_id":"50987122-41db-4254-997d-98dc1dc59084","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"A comprehensive evaluation of marker-based, markerless methods for loose garment scenarios in varying camera configurations.Frontiers in Computer Science, 6: 1379925, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:a1711ff77146f29f8a2412da8ccf24690c4090b034e2a627b5ef2667c00b56f6","observation_id":"518d3b4b-b470-470b-8493-912f94f55c3d","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"High-resolution image syn- thesis with latent diffusion models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:daaf7db53858368df9b27cd5ead4b32ab345292b29ea414994dd7c9e70950290","observation_id":"713b6ad6-ee01-4e11-9869-a112ef838e84","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:3de3025d2c624e31bbc0b0e822aa3d6654e0e9de10ad1847105e5892f5909469","observation_id":"56d4369a-9d43-4337-8c33-bdd815d76693","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Dinov3.arXiv preprint arXiv:2508.10104, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:be9f153b95e840a6392902029c84b5f39d7423f7de694a3743ff54c4b9d37a33","observation_id":"788ceed3-3ae3-47ff-9c74-4452da6cff26","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Hand-object interaction pretraining from videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:ed2783873cd96e1027ee020b477591c7ecd9661a2b4218e08d50d89bce46440e","observation_id":"3c1c18b3-ed8c-44b3-9696-4d22ea9f8a03","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19088","last_updated":"2025-01-31T12:33:24Z","snapshot_observed_at":"2026-08-05T20:50:05.054605Z","submitted_at":"2025-01-31T12:33:24Z","title":"JGHand: Joint-Driven Animatable Hand Avater via 3D Gaussian Splatting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19088","snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Jghand: Joint-driven animatable hand avater via 3d gaussian splatting.arXiv preprint arXiv:2501.19088","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"cited_paper":"/paper/2501.19088","citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:3ded0ae88a30b3ec0fba499b16c3ede17bb0ecf274d96db0eb220cac417ee58a","observation_id":"88862a29-e7db-464c-810e-01aa1cda49e9","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-07-06T07:19:11.957225Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"To- wards accurate generative models of video: A new metric & challenges.arXiv preprint arXiv:1812.01717, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:5d98e8c007df68c849f2ca3e51c68250710ede5f3412853e2afe1680da54c701","observation_id":"52dd9d77-1262-47d3-973c-bc023eeea68e","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Markerless motion capture for dual- handed teleportation of industrial robots","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:59a8e5dc1f24dd6f9a8509f802bacd38719693a82d093a510ef7d40c919c9bfe","observation_id":"661a278b-e27b-4b36-98ba-23a7f20ddba0","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06843","last_updated":"2025-03-11T16:48:26Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-10T23:25:19Z","title":"HO-Cap: A Capture System and Dataset for 3D Reconstruction and Pose Tracking of Hand-Object Interaction","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06843","snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Ho-cap: A capture system and dataset for 3d reconstruction and pose tracking of hand- object interaction.arXiv preprint arXiv:2406.06843","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"cited_paper":"/paper/2406.06843","citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:c6a664c20aba4675cef7d788e0afdefe077ca1ee03d6fe118a58456e09f4a95b","observation_id":"a9f18d44-91a4-44f0-be2d-18a4022c175d","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Vihand: Enhancing 3d hand pose estimation with visual-inertial benchmark","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:12afa693ee72fbafb769743ae384d7cd5abb9e6bd58f1a75839be2226c1708e8","observation_id":"b7437147-95ac-4433-b114-c39fb86a590a","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Interdiff: Generating 3d human-object interactions with physics-informed diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:565e01e3c47d20edea1ba967b5e6f84dc477ad935015c0628bb28fc4a71ed7a4","observation_id":"4b9efe65-c333-4ff1-8abf-f8feab4874c2","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Visual-tactile sensing for in-hand ob- ject reconstruction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:d15ba8c1d8c397e11c394c24c2d5b48a7becd2f85f5233192b32ff494e1121ec","observation_id":"eb12e36f-5bcb-41c4-bf4c-653dd6e76c52","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Egopca: A new framework for egocentric hand-object interaction un- derstanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:8cd473b755b3b757f7cb9234eb3360e94523369907bb4a4abea6985056fc486c","observation_id":"788ad6a5-66bc-48d4-9b4a-a67abae7dde3","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Rerender a video: Zero-shot text-guided video-to-video translation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:4f280762132152a6f01769f594f3b3058889662ea7a17c1474ee6a52689914e0","observation_id":"5321a00c-f507-4276-8ced-5119057745b4","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Fresco: Spatial-temporal correspondence for zero-shot video translation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:a25fd1a011545932e3cf694fdada2bc84692965b3650964bf8c7e478566f33d7","observation_id":"29624ba7-c777-4d2a-bb38-6c172e183e64","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"gsplat: An open-source library for gaussian splatting.Journal of Ma- chine Learning Research, 26(34):1–17, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:409ea402b717c2e53be6d8f22debfe54d5f98b2eedb5e7803b0a20fa5ff41548","observation_id":"1ea54ffa-eddd-4b6f-bdb3-efe6159d9b74","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Affordance diffusion: Synthesizing hand-object interac- tions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:751574849c5b7cfeb76905b573085cbd065e68bbba5486ae4c0acae920b210ef","observation_id":"bf8a6a30-3a52-41bd-8c61-020852d104ba","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06790","last_updated":"2023-04-13T19:23:52Z","snapshot_observed_at":"2026-08-05T23:54:40.289344Z","submitted_at":"2023-04-13T19:23:52Z","title":"Inpaint Anything: Segment Anything Meets Image Inpainting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06790","snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Inpaint anything: 11 Segment anything meets image inpainting.arXiv preprint arXiv:2304.06790, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"cited_paper":"/paper/2304.06790","citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:e1c8b943cd02f88b95d79fcfc9d06e932aaf0d584dc6f9e15307e8329f4fd911","observation_id":"ae52c37a-1778-4324-870b-ccaa73e0eb7a","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Hand1000: Generating realistic hands from text with only 1,000 images","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:bb24eb789dc744dc7548341b08045f3a65ddbc12a9068c9ff3111cb4ff562c3e","observation_id":"94835c17-d5a6-4c75-83a4-54553396a740","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:7b020dc23f3bd20ff8d11949c442fecf9b57ed053cca2c7a81abe6f139d52b4f","observation_id":"2c8e8ca9-5a41-44db-becb-2528252965c4","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Hoidiffusion: Generating real- istic 3d hand-object interaction data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:55e4013c7a541994f4c91dbf108b1a17f89c8e18399c131bb7166771c7b65f26","observation_id":"f94d1821-e1dc-4926-bd56-23b87164aa5d","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Motion blender gaussian splatting for dynamic scene reconstruction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:702aaf90f660d9808424a7886d8720752f68c813ad6139b910dec914bfc74704","observation_id":"ef8d574c-18aa-4e38-a9be-c2bd5bbc90f2","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Gaussianhand: Real-time 3d gaussian rendering for hand avatar animation.IEEE Transactions on Visualization and Computer Graphics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:3512c7a81a1254cd383c8b1664ad5443fd140f397ae661e5360c2986a25a061d","observation_id":"35893ff8-6d69-4b8b-8558-bc75e16bb260","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Egopressure: A dataset for hand pressure and pose estimation in egocentric vision","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:9e13b1677e6983e34a0b66e8f6d69ca67b09b0448d227f9d6318e900619bc862","observation_id":"3aed80c2-b0b7-4fda-9a44-da60f89d1679","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Ohta: One-shot hand avatar via data-driven implicit priors","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:3f147a75e01034d8276686867256d25a3ab50fbba6e68f162db940cfcf9e05e0","observation_id":"3da0a5d2-a1d6-4777-b13a-02fddabf9e4f","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Propainter: Improving propagation and transformer for video inpainting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:8ca1fc917a2fc3b74bccd59fda5df9c20a9a2572f9076e8e723577046c80e268","observation_id":"ba960a3b-2115-4ace-a752-9213b117a1a6","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"A wearable smart glove for tactile interaction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:9e779920f4a073fcd6fe97d0b75eeab7c85be332602ace779f92804e8ce6596c","observation_id":"8e1a8f1e-abea-487b-be08-136fd5ec36e4","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Unpaired image-to-image translation using cycle- consistent adversarial networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:d1ed730a7357bf258d39ecba9df0008b6ce84016d2e8823781c20758c20a4f75","observation_id":"7c7125c0-3c98-46c6-8c15-40f53aa510fb","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Next, we outline the data collection protocol for theHandSensedataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:fba61f58c752e026f8056a50f9b8fae8a61334aee4d835c302d051d892b41bf9","observation_id":"facee9bd-af15-44bf-873b-6492fc8a8ff3","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Open the mustard bottle using only your index finger and thumb","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:b4d3185b7012a78c46563b34975cbacb479f207489fdfa9dea3c24b5d2e11c52","observation_id":"513715b5-1f3f-47f6-899b-e5357ca0d49d","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Hold the object with index, thumb, and middle fingers; rotate it in front of you","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:b6a14e7477a7f6d94b2c57e3a5cc8a8392ee4525d1a0674a6b8b53deddc9e98d","observation_id":"f95478c1-a298-4ce2-b620-5ed389565f3e","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Press different piano keys sequentially using only your ring finger","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:1492890d7894a36b3244a93546508a2230f3bb121e4762fa8a442382677bab05","observation_id":"0528b346-7ebe-479c-8803-4f5f7524fcf0","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Pick up the object using a whole-hand grasp and place it on the table","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:11c42e4895e1f2e667ef0b3d662d4c2dba9b9f388c1be91008ead8a6decf0848","observation_id":"76c6ff09-bec9-4b58-9b70-a9080d28148b","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Press and slide your index finger firmly against the table surface","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:db537f0dd30a5cb1304c44977815d66de5fdad08b098ca1559761a96cfb406be","observation_id":"f511e713-a658-45bc-a5d3-b6a9d4d6d8c6","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T21:11:31.022938Z","title":"Rotate the object within your hand, maximizing finger contact and occlusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-07-13T21:11:31.022938Z"},"links":{"citing_paper":"/paper/2603.20850"},"observation_digest":"sha256:16dd543d5445ceb770bfd7d00bee059ff0522cd4b7d1104d2ad29b93efa1a014","observation_id":"8401f20b-1141-4e2d-9ec5-c88ff66c8d51","resolution":{"observed_at":"2026-07-13T21:11:31.022938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.20850","last_updated":"2026-06-08T23:42:26Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-13T21:11:29.774281Z","submitted_at":"2026-03-21T15:12:57Z","title":"Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves"},"reference_resolution":{"displayed":90,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":90,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":90},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 90 of 90 outbound references and 3 inbound Pith citation observations for arXiv:2603.20850."}