{"as_of":"2026-08-22T22:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eb98dfa2129b0ddeaffd2c801896e4c74ec1fc7644d1b47cdbd211d222e9c4e7","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T04:04:22.256638Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.06226/citation-record","integrity":"/paper/2602.06226/integrity","json":"/paper/2602.06226/citation-record.json","paper":"/paper/2602.06226"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:14.972803Z","title":"Follow my hold: Hand-object interaction re- construction through geometric guidance, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:14.972803Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:82ef7f64b11e36654f188b96abf4ec2d4031bda94759a433aee72a1cdb1f673e","observation_id":"de9ebcd2-09cb-4bb5-a339-aab1d77c6a5f","resolution":{"observed_at":"2026-08-03T04:04:14.972803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:15.035059Z","title":"Push- ing the envelope for rgb-based dense 3d hand pose estima- tion via neural rendering","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:15.035059Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:47cb39b886c9d0532502f3691ae0d1195559edbe621e9282fd135edfcda5a560","observation_id":"70802a5c-8e57-41a4-b59f-11c5b0cf8ed1","resolution":{"observed_at":"2026-08-03T04:04:15.035059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:15.091771Z","title":"HOT3D: Hand and object tracking in 3D from ego- centric multi-view videos.CVPR, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:15.091771Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:307cbd6187eb5e3e223a8bf2366f2525bdf3e23e487d71d82527a3fcfa31d212","observation_id":"dad3d51f-7856-4f1b-89e2-559fb69e097d","resolution":{"observed_at":"2026-08-03T04:04:15.091771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:15.190619Z","title":"Reconstructing hand-object interactions in the wild","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:15.190619Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:bbda95108883bcea94f79ef0a54f17eb2abcd91c38cb6cab343b066eb4694f36","observation_id":"2aec8912-7494-49af-98e3-c8c4f6136c7f","resolution":{"observed_at":"2026-08-03T04:04:15.190619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:15.258318Z","title":"Reconviagen: Towards accurate multi-view 3d object reconstruction via generation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:15.258318Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:d98bc7bae48a21ffaac9f349b1d2156ffde4b09f7ffd1a85e4c9ab573ae25f1f","observation_id":"dc9c2b4c-2192-4fb0-a329-21f43246d0f2","resolution":{"observed_at":"2026-08-03T04:04:15.258318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05517","last_updated":"2026-06-26T01:37:50Z","snapshot_observed_at":"2026-08-18T11:22:23.188709Z","submitted_at":"2025-05-07T16:13:17Z","title":"Web2Grasp: Learning Functional Grasps from Web Images of Hand-Object Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05517","snapshot_observed_at":"2026-08-03T04:04:15.362070Z","title":"Web2grasp: Learning functional grasps from web images of hand-object interactions.arXiv preprint arXiv:2505.05517, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:15.362070Z"},"links":{"cited_paper":"/paper/2505.05517","citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:06393c4600b743de4ed9cffd607e9b920b1efcee785e9489eae16cd870096ce5","observation_id":"f3dd055e-9d18-46fc-b9c9-39a76fad1fb5","resolution":{"observed_at":"2026-08-03T04:04:15.362070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:15.451785Z","title":"Handos: 3d hand reconstruction in one stage","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:15.451785Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:0ffd785c3a2a808b13ece0a26d1ac94466ebdcbfaff9b41479d34aa920fa2666","observation_id":"f2462572-a439-4e84-b50f-3c00a0779813","resolution":{"observed_at":"2026-08-03T04:04:15.451785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:15.555491Z","title":"AlignSDF: Pose-Aligned signed distance fields for hand-object reconstruction","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:15.555491Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:0e6d6b10bba3a459da818a3673d5f0dabcc769f389e16732881c05f3f1ec344a","observation_id":"34d7e9ad-fbae-4d21-9c5b-1cb82755d534","resolution":{"observed_at":"2026-08-03T04:04:15.555491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:15.627822Z","title":"gsdf: Geometry-driven signed distance functions for 3d hand-object reconstruction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:15.627822Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:66c2b670dd5fa57fc6eb759289bd15842b26d765f1b50a89bb45a52aa0db9ad4","observation_id":"7f89b12f-d0e9-421a-aa9e-1b3dded78c1d","resolution":{"observed_at":"2026-08-03T04:04:15.627822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21313","last_updated":"2025-07-21T10:20:41Z","snapshot_observed_at":"2026-08-17T09:32:28.655338Z","submitted_at":"2025-03-27T09:45:09Z","title":"HORT: Monocular Hand-held Objects Reconstruction with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21313","snapshot_observed_at":"2026-08-03T04:04:15.725131Z","title":"HORT: Monocular hand-held ob- jects reconstruction with transformers.arXiv preprint arXiv:2503.21313, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:15.725131Z"},"links":{"cited_paper":"/paper/2503.21313","citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:ecd4e1c4901ac4e763ddf353dc8d48a93f11b1764852e3561bcb632143ff8a69","observation_id":"9eb0d13f-f7b3-4a2b-a904-555e51435f6a","resolution":{"observed_at":"2026-08-03T04:04:15.725131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:15.862564Z","title":"D-grasp: Physi- cally plausible dynamic grasp synthesis for hand-object in- teractions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:15.862564Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:77ced225092d9603b05d38c55a557eeaa4db1c5b83da2b57ca77fe266ce37122","observation_id":"5d066c53-dd12-47be-bf9b-e8dda7afcc04","resolution":{"observed_at":"2026-08-03T04:04:15.862564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:15.932547Z","title":"Blender Foundation, Stichting Blender Foundation, Amsterdam, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:15.932547Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:2788823296b76109d048171653479a3a00debe7731a1d6f551053723e5b12bf8","observation_id":"29315e1e-f099-4d1d-8c5c-b807b3cf18aa","resolution":{"observed_at":"2026-08-03T04:04:15.932547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:16.002302Z","title":"Ganhand: Predicting human grasp affordances in multi-object scenes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:16.002302Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:e9aa6109221eaa4e83fc466341b04cb46fef54ca367ba7ff76f03052183403fb","observation_id":"d4054cdc-4703-4f46-b475-12da57f69768","resolution":{"observed_at":"2026-08-03T04:04:16.002302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08051","last_updated":"2022-12-15T18:56:53Z","snapshot_observed_at":"2026-08-16T16:08:20.723586Z","submitted_at":"2022-12-15T18:56:53Z","title":"Objaverse: A Universe of Annotated 3D Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08051","snapshot_observed_at":"2026-08-03T04:04:16.097166Z","title":"Obja- verse: A universe of annotated 3d objects.arXiv preprint arXiv:2212.08051, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:16.097166Z"},"links":{"cited_paper":"/paper/2212.08051","citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:a629ab52841d30c593683aa8cd5cbf5a02d97c71a72a512971bdc22f747f0f31","observation_id":"ae144728-5d2e-442f-870a-a49bbad8681f","resolution":{"observed_at":"2026-08-03T04:04:16.097166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:16.225598Z","title":"Bench- marks and challenges in pose estimation for egocentric hand interactions with objects","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:16.225598Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:ed78e95606b794f72ab1e3b6688b2fca73da767798fb9dfcc5a2958ca78608fe","observation_id":"5f4365a6-9f38-4873-a74c-4e32e92ab6d1","resolution":{"observed_at":"2026-08-03T04:04:16.225598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:16.331530Z","title":"HOLD: Category-agnostic 3d reconstruction of in- teracting hands and objects from video","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:16.331530Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:45c55b30809f81100b4c9ebd2a74bf8cac7ef3ad4613982f5d5088ea8ab4d863","observation_id":"3cc31f57-1551-43e4-8c48-dc81ffe02e30","resolution":{"observed_at":"2026-08-03T04:04:16.331530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:16.400646Z","title":"Fischler and Robert C","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:16.400646Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:7cabbfe8c110a3e4811a48589d3d4db2ff083a0f80a25df431c1655034dcbfa8","observation_id":"e411e1a4-26f3-45e4-ae49-af55c1e99c79","resolution":{"observed_at":"2026-08-03T04:04:16.400646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:16.468907Z","title":"Gigahands: A massive annotated dataset of bimanual hand activities","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:16.468907Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:2853e98acbb1d9a3c771083d67929ec113e1da59cd54fbac0248834368a913b9","observation_id":"2239db45-a0ac-428f-9cc0-8664c8d29525","resolution":{"observed_at":"2026-08-03T04:04:16.468907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:16.539392Z","title":"Honnotate: A method for 3d annotation of hand and object poses","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:16.539392Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:573569133fddf28174860e8827d6e0ad0ae5ab92a5b9eb22b3f3b6566ccbda78","observation_id":"541d746a-4046-4ffc-b252-4da48e39b977","resolution":{"observed_at":"2026-08-03T04:04:16.539392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:16.600737Z","title":"Keypoint transformer: Solving joint identifica- tion in challenging hands and object interactions for accurate 3d pose estimation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:16.600737Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:3411ed0155bb73e756e533f9090865c7e18b65a4208202e3d5da2b2949aa575d","observation_id":"b26be45a-b4ac-4677-bdc2-80e60ae88e84","resolution":{"observed_at":"2026-08-03T04:04:16.600737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:16.669177Z","title":"Keypoint transformer: Solving joint identifica- tion in challenging hands and object interactions for accurate 3d pose estimation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:16.669177Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:204154adf24cff7680de35b1b3fc6bcac919349c503b5e35df62d885b9a1c5d1","observation_id":"f84d36e6-1a2c-4b08-a3e8-a97f8d65a37d","resolution":{"observed_at":"2026-08-03T04:04:16.669177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:16.731565Z","title":"Black, Ivan Laptev, and Cordelia Schmid","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:16.731565Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:f57703dc56cc3dba277f6ed1016620caa5630a2d4e175b6c90965f96aa000b97","observation_id":"3e81e8a8-3ef2-4dcb-b046-af5c41a89514","resolution":{"observed_at":"2026-08-03T04:04:16.731565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:16.796652Z","title":"Black, Ivan Laptev, and Cordelia Schmid","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:16.796652Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:e5b12b15dd88628e8afbfda71f75f4cc2be55703f1fbc612bac5352d15f9ab61","observation_id":"a012569c-8c33-4193-9246-22a110345922","resolution":{"observed_at":"2026-08-03T04:04:16.796652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:16.861365Z","title":"Viewdiff: 3d-consistent image generation with text-to-image models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:16.861365Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:9125a4fca389e8824ba541298680aea9cb2b6b5e56d999dd94df851982c33df6","observation_id":"ad3ca2fc-d20f-4ee8-b8e2-2dcfb2087f94","resolution":{"observed_at":"2026-08-03T04:04:16.861365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:16.920498Z","title":"Cupid: Pose-grounded generative 3d reconstruction from a single image, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:16.920498Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:a7f3b111900e0c1844f61c833ddc718e4d4e3190e4fb4bc5b905fd104605af67","observation_id":"a16faa24-fe3b-47db-844b-09c4244bae87","resolution":{"observed_at":"2026-08-03T04:04:16.920498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:17.022553Z","title":"Reconstruct- ing hand-held objects from monocular video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.022553Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:8d1e069a9603cddfeecf28e0d46a7034d357dc33e6f5bc242ee723477c94ec48","observation_id":"d01480b3-c7aa-4c23-9aa2-a874abe1e988","resolution":{"observed_at":"2026-08-03T04:04:17.022553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:17.091344Z","title":"Affordpose: A large-scale dataset of hand-object inter- actions with affordance-driven hand pose","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.091344Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:9aed07c790e6e1ea56bea79b570ce37901a7d68c1048dbbfc13b4f20bf86b486","observation_id":"eea9368a-abb2-49e2-9e48-b4ef188ac90e","resolution":{"observed_at":"2026-08-03T04:04:17.091344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:17.163731Z","title":"In-hand 3d object recon- struction from a monocular rgb video","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.163731Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:280adfa04a34378a54e3d609bef3dddb3ea0fbb7493e8eb8a94dc29f5ac88fb5","observation_id":"3a32e69f-bac5-4522-b29b-7201d39e6738","resolution":{"observed_at":"2026-08-03T04:04:17.163731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:17.227902Z","title":"Hand-held object reconstruction from rgb video with dynamic interaction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.227902Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:42598688aa1af340f114de70306f4d411cba97c508e79f49f3aee119f27ee870","observation_id":"48f05ff6-1b75-47fd-8ce4-45cae2712377","resolution":{"observed_at":"2026-08-03T04:04:17.227902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:17.285485Z","title":"Hand-held object reconstruction from rgb video with dynamic interaction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.285485Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:be57a34055cce1fdf341b4705b401cdac17a3d76d208f7f75757315ce6a4dff8","observation_id":"9594e1f4-1b8c-4dfb-87e3-d1f2e24162c3","resolution":{"observed_at":"2026-08-03T04:04:17.285485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00255","last_updated":"2025-02-20T18:06:19Z","snapshot_observed_at":"2026-08-16T13:13:56.200323Z","submitted_at":"2024-09-30T21:55:38Z","title":"Robin3D: Improving 3D Large Language Model via Robust Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00255","snapshot_observed_at":"2026-08-03T04:04:17.351824Z","title":"Robin3d: Improving 3d large lan- guage model via robust instruction tuning.arXiv preprint arXiv:2410.00255, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.351824Z"},"links":{"cited_paper":"/paper/2410.00255","citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:0d92004c673b2cc85e559ba5bd4de7c4a1a3b0ce4d97cb2c2f27e9e8385a8ac6","observation_id":"e1f86299-4e54-4422-aba7-7f5c37ed25d4","resolution":{"observed_at":"2026-08-03T04:04:17.351824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:17.423811Z","title":"Bronstein, and Stefanos Zafeiriou","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.423811Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:ee96efeaf59801f6911e042f6c4b86a7dc33bb880dbce582eb516c06ff306200","observation_id":"9b9aeb47-4e51-486e-adf1-153942dc659c","resolution":{"observed_at":"2026-08-03T04:04:17.423811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:17.484828Z","title":"Ground- ing image matching in 3d with mast3r, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.484828Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:95c64683232284c578d222b8df3f746957940224a208063db6002632d85190af","observation_id":"6626391c-5afd-415f-a6ad-986516fc394a","resolution":{"observed_at":"2026-08-03T04:04:17.484828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:17.561413Z","title":"Instant3d: Fast text-to-3d with sparse-view generation and large reconstruction model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.561413Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:910cdda7085e67951e52d1c793301ed80fdb7ebe4c7c81c9a9712f5b07e723da","observation_id":"802ea3a1-7ef0-4298-9cef-9b47d06938a6","resolution":{"observed_at":"2026-08-03T04:04:17.561413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:17.604500Z","title":"Scalable vision-language-action model pretraining for robotic manip- ulation with real-life human activity videos.arXiv preprint arXiv:2510.21571, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.604500Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:adc5e1d0b569c9e5393c594d74d42b557dd3dbd560a18bec4362f76b36c1d9c1","observation_id":"3594fb5a-8bc0-4359-86a4-b84976122a60","resolution":{"observed_at":"2026-08-03T04:04:17.604500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06608","last_updated":"2025-03-27T17:25:50Z","snapshot_observed_at":"2026-07-06T20:34:02.031605Z","submitted_at":"2025-02-10T16:07:54Z","title":"TripoSG: High-Fidelity 3D Shape Synthesis using Large-Scale Rectified Flow Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06608","snapshot_observed_at":"2026-08-03T04:04:17.709615Z","title":"Triposg: High-fidelity 3d shape synthesis using large-scale rectified flow models.arXiv preprint arXiv:2502.06608, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.709615Z"},"links":{"cited_paper":"/paper/2502.06608","citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:d327554d59aeea95a35edbe01fe9ced3cc47ee6d4fe26ace104d83f78a9bb3c8","observation_id":"06ad5c97-427b-4d23-a8a3-3daabe3da167","resolution":{"observed_at":"2026-08-03T04:04:17.709615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:17.771550Z","title":"End-to-end hu- man pose and mesh reconstruction with transformers","venue":null,"work_id":null,"year":1954},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.771550Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:d6182810fb64a94e965b093f735465d07998fc16b584d9720d33053c89668cde","observation_id":"d6847ee4-3267-44aa-b675-829599cdb10b","resolution":{"observed_at":"2026-08-03T04:04:17.771550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:17.811077Z","title":"Zero-1-to-3: Zero-shot one image to 3d object, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.811077Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:a3093f3bbd24daf1b644f86e0206134943f56565bd6a0355b3bad1bb64c3e700","observation_id":"74315b02-a145-43ed-be68-125e6e8bc090","resolution":{"observed_at":"2026-08-03T04:04:17.811077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:17.872219Z","title":"Semi-supervised 3d hand-object poses es- timation with interactions in time","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.872219Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:7903a1f19e84c93be472f11a36ea8f13420f1a2d538f44ec7f27730aef0cef62","observation_id":"3ce47f7a-198d-4a19-bc42-f8af8c89c6e2","resolution":{"observed_at":"2026-08-03T04:04:17.872219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:17.921863Z","title":"Semi-supervised 3d hand-object poses es- timation with interactions in time","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:17.921863Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:cfebd32b0409519f300e25ddfd33dd91d49ff143967891dae8546012cedff38e","observation_id":"e8707216-1717-4519-857b-37980cc90890","resolution":{"observed_at":"2026-08-03T04:04:17.921863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:18.024742Z","title":"Hoi4d: A 4d egocentric dataset for category-level human- object interaction","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:18.024742Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:bc65cb63954801a74f72b1330b4f96bdde627b12a3998121051854340a78b1e5","observation_id":"196ede35-27f5-49f7-80ad-c7713bbce712","resolution":{"observed_at":"2026-08-03T04:04:18.024742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03453","last_updated":"2024-04-15T10:28:44Z","snapshot_observed_at":"2026-08-12T22:52:54.817720Z","submitted_at":"2023-09-07T02:28:04Z","title":"SyncDreamer: Generating Multiview-consistent Images from a Single-view Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03453","snapshot_observed_at":"2026-08-03T04:04:18.100570Z","title":"Syncdreamer: Gen- erating multiview-consistent images from a single-view im- age.arXiv preprint arXiv:2309.03453, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:18.100570Z"},"links":{"cited_paper":"/paper/2309.03453","citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:7f6469a8df992eca860d1c8ab5fefbf8ccd3fd8b9779e10b9a95eb79d3896a4e","observation_id":"cdc02560-ddff-4ebd-9de4-da1b05a42712","resolution":{"observed_at":"2026-08-03T04:04:18.100570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:18.167484Z","title":"Easyhoi: Unleashing the power of large models for reconstructing hand-object interactions in the wild","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:18.167484Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:539fc07c81465c1339e79cfd99c26562f65b77a739913e9d98ef2293a0d8c97a","observation_id":"a0d86ec1-a6cf-486d-915e-6acf22585f70","resolution":{"observed_at":"2026-08-03T04:04:18.167484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:18.218863Z","title":"Vilbert: Pretraining task-agnostic visiolinguistic representations for vision-and-language tasks.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:18.218863Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:39df962d3642bc594e3f5e9d77c5efe8cc30055bca8fc93e217a60985231e830","observation_id":"c3e73814-5878-4d92-ab99-a585473c33f9","resolution":{"observed_at":"2026-08-03T04:04:18.218863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:18.283793Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:18.283793Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:76c0e7c5e64f3a109e7c7d4a642f5343c8d4edbeded79867b66ca86673fd8a55","observation_id":"3637d144-5815-4bef-9997-11a77bfee151","resolution":{"observed_at":"2026-08-03T04:04:18.283793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:18.352064Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:18.352064Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:b040d46bb24fd0084e2bc5527a1b2826beeabf03a909726b0b7c6d08e2d42644","observation_id":"f7d6bc15-2070-4464-8fa7-3a6fe207f983","resolution":{"observed_at":"2026-08-03T04:04:18.352064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:18.391333Z","title":"Recon- structing hands in 3d with transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:18.391333Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:e740db4cb9eef0293ba15255629825abfbae687babca8b41bf44501b9f9d2e2e","observation_id":"e403dd3e-7b49-4121-a3b0-3e705f0c964d","resolution":{"observed_at":"2026-08-03T04:04:18.391333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:18.466775Z","title":"Barron, and Ben Milden- hall","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:18.466775Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:b00e9849acef01f0c34b212d8bbe9f30e66da04eb1cffaba537832c5aca53a52","observation_id":"63660379-5475-4bd6-8b71-3a94fa3ffb02","resolution":{"observed_at":"2026-08-03T04:04:18.466775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:18.519237Z","title":"Wilor: End-to-end 3d hand localization and reconstruction in-the-wild, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:18.519237Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:d752ef51ebbf9c472b27592067e7f29a84bbc8d6fe35b435c8544b5a17633061","observation_id":"588f1c24-2517-407b-b349-09fad444b9d0","resolution":{"observed_at":"2026-08-03T04:04:18.519237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:18.675246Z","title":"3d reconstruction of objects in hands without real world 3d supervision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:18.675246Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:a10701e9c863d3bdde63bbd7fbc297f4c65c57049a33ed1d820e430cd3007fd2","observation_id":"5127fbf1-60f7-4e4a-bf1f-e4f990f33d59","resolution":{"observed_at":"2026-08-03T04:04:18.675246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:18.750357Z","title":"HTML: A Para- metric Hand Texture Model for 3D Hand Reconstruction and Personalization","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:18.750357Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:aa06c23632067c5821ba476c8c9b210d5a0de4cdaab23bbee1e2b8172aa2b508","observation_id":"18a8fb5b-ae82-44c6-8c8a-d829ddeb7384","resolution":{"observed_at":"2026-08-03T04:04:18.750357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:18.829780Z","title":"Novel- view synthesis and pose estimation for hand-object interac- tion from sparse views","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:18.829780Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:8655fa8da26173178add64bb525dabe223ab75dc2412ef394b440ab1e044db95","observation_id":"c0ad708f-9fb4-4390-af03-b816198785db","resolution":{"observed_at":"2026-08-03T04:04:18.829780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:18.947069Z","title":"High-resolution image syn- thesis with latent diffusion models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:18.947069Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:b32f6cf59e116ca5fe49225972d785e800ae4a7e5e05266fc0d1793a7ecde029","observation_id":"5e17290d-d0dc-4cdc-8715-e632555fc6b1","resolution":{"observed_at":"2026-08-03T04:04:18.947069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:19.100444Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:19.100444Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:c8d32e40d9461189d4ffbe76a0e8a278ce00e7ef099aded1fd068f78e76a306b","observation_id":"d7ec4f5a-51e2-412a-88a0-4183c3d32211","resolution":{"observed_at":"2026-08-03T04:04:19.100444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:19.236744Z","title":"Photorealistic text-to-image diffusion models with deep lan- guage understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:19.236744Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:be90c0aa8a4a08a0a6c3705c267f63bcc28ec8c16d5cf16967c9b4036ed9605c","observation_id":"499efd33-4f07-4a8a-af86-7a859405304d","resolution":{"observed_at":"2026-08-03T04:04:19.236744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:19.390451Z","title":"SuperGlue: Learning feature matching with graph neural networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:19.390451Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:4208e10122f4fa80811e6f83124058b6543f480f0ae60932481625f4eac349ad","observation_id":"c0f0d261-655a-46a3-b4c9-4cdec062d814","resolution":{"observed_at":"2026-08-03T04:04:19.390451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:19.491913Z","title":"Visual odom- etry [tutorial].IEEE Robotics & Automation Magazine, 18 (4):80–92, 2011","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:19.491913Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:ed108c3ad7d7d56e8a3bcc90058f2106187350b19ef70d5c87a11cc50d913bae","observation_id":"a823dfa1-889d-4fee-a91d-1ec5078eb55f","resolution":{"observed_at":"2026-08-03T04:04:19.491913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15110","last_updated":"2023-10-23T17:18:59Z","snapshot_observed_at":"2026-08-15T06:11:26.743203Z","submitted_at":"2023-10-23T17:18:59Z","title":"Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15110","snapshot_observed_at":"2026-08-03T04:04:19.671868Z","title":"Zero123++: a single image to consistent multi-view dif- fusion base model.CoRR, abs/2310.15110, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:19.671868Z"},"links":{"cited_paper":"/paper/2310.15110","citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:3a8c3c7213e4c60eb98d3582a98acf105b51bee557d13302480afb7122bac419","observation_id":"2f0d42bb-94b9-4112-9d7b-6b5d27de7be3","resolution":{"observed_at":"2026-08-03T04:04:19.671868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:19.834303Z","title":"Hunyuan3d 2.1: From images to high-fidelity 3d assets with production-ready pbr material,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:19.834303Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:6fb2c5928d637bf05142500ec1b328a8aea6c50cc8b5a037011d67f167c96b80","observation_id":"6a58b0b8-4937-4cea-bd31-9ef6dfaab789","resolution":{"observed_at":"2026-08-03T04:04:19.834303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:19.982802Z","title":"Hunyuan3d 2.0: Scaling diffu- sion models for high resolution textured 3d assets generation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:19.982802Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:c048b1ed1c77352a82acc912240f2d327c542bf61d80bf6066b91389df87d0f8","observation_id":"b3b1100b-ea81-4a5e-bd2d-78b4931cf849","resolution":{"observed_at":"2026-08-03T04:04:19.982802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:20.125589Z","title":"H+o: Uni- fied egocentric recognition of 3d hand-object poses and in- teractions","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:20.125589Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:78ea29ced5fb4d6bf1e2cd22788f28bf2aea1afdbb7200090b6e07db17bcc6b6","observation_id":"2936fa59-e489-4232-90af-174008751eba","resolution":{"observed_at":"2026-08-03T04:04:20.125589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02151","last_updated":"2024-03-04T16:00:56Z","snapshot_observed_at":"2026-07-06T17:39:16.540553Z","submitted_at":"2024-03-04T16:00:56Z","title":"TripoSR: Fast 3D Object Reconstruction from a Single Image","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02151","snapshot_observed_at":"2026-08-03T04:04:20.244420Z","title":"Triposr: Fast 3d object reconstruction from a single image.arXiv preprint arXiv:2403.02151, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:20.244420Z"},"links":{"cited_paper":"/paper/2403.02151","citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:e05abfe1c95d93b0a41ce9e4f0e92f54d6449848cfad8acc6edcd2a849ac88c3","observation_id":"62cd4d4e-eaa2-456a-b496-d62a31b8885b","resolution":{"observed_at":"2026-08-03T04:04:20.244420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:20.363077Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:20.363077Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:0a982f3e2c02bde015333a5d9c2ab97cf1f349ca30b64c5bab667c39485b7255","observation_id":"ab6e4da4-8ee8-41de-84a9-687eabcb4f3c","resolution":{"observed_at":"2026-08-03T04:04:20.363077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.10689","last_updated":"2023-02-01T06:00:21Z","snapshot_observed_at":"2026-08-02T09:26:48.635481Z","submitted_at":"2021-06-20T12:59:42Z","title":"NeuS: Learning Neural Implicit Surfaces by Volume Rendering for Multi-view Reconstruction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.10689","snapshot_observed_at":"2026-08-03T04:04:20.540507Z","title":"Neus: Learning neural implicit surfaces by volume rendering for multi-view reconstruction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:20.540507Z"},"links":{"cited_paper":"/paper/2106.10689","citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:68952aad3e50becfd53053174f92aa1635895390febfd86b7d2c260c1f0e1da2","observation_id":"5b1b28f9-82d1-41c1-8eca-a2eb1e76b44a","resolution":{"observed_at":"2026-08-03T04:04:20.540507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:20.679241Z","title":"Magichoi: Leveraging 3d priors for accurate hand-object reconstruction from short monoc- ular video clips","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:20.679241Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:8f156902dcf0cd64d826f257c0b20f9fa4c43320c0ce5aba53ccf6d676ff259a","observation_id":"54f3c111-6d47-4d2a-8402-4548b99d576c","resolution":{"observed_at":"2026-08-03T04:04:20.679241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:20.880855Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:20.880855Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:48545d76da074e6c3dce0bdfe7b7ca31d8bbde37e234594930cc7c6fba035716","observation_id":"df05f0e8-bf63-477b-b868-85aff25a6d72","resolution":{"observed_at":"2026-08-03T04:04:20.880855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:21.047526Z","title":"Novel view synthesis with diffusion models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:21.047526Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:ed6e6d40f030778e783c64a337b3155baaa551e6d24158be094358b88dc7b32e","observation_id":"85c19f17-0c20-47c5-8d2a-f09f858e5e76","resolution":{"observed_at":"2026-08-03T04:04:21.047526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:21.209707Z","title":"BundleSDF: Neural 6-DoF tracking and 3D reconstruction of unknown objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:21.209707Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:22f810a0ee0c9489aaf02565e9ef10885f83dd48f96533df0913d24764b3babd","observation_id":"7294d0ca-fb36-4c3b-b44b-8b0fbffa5baf","resolution":{"observed_at":"2026-08-03T04:04:21.209707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:21.324263Z","title":"Reconstructing hand-held objects in 3d.arXiv preprint arXiv:2404.06507, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:21.324263Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:48c6cd79789d7775808a8e7da81eddbc25d3e1e85da1acf43a41ba1eefa8f32d","observation_id":"0c12b59a-9411-4d3c-b247-42b7d3293c4e","resolution":{"observed_at":"2026-08-03T04:04:21.324263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:21.456912Z","title":"Srinivasan, Dor Verbin, Jonathan T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:21.456912Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:e7cdc11580e388903b3c32e37135e4f2521f25d16d9f895de9874252c9dd88af","observation_id":"48c39038-6324-4a26-91f2-b6920730e839","resolution":{"observed_at":"2026-08-03T04:04:21.456912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01506","last_updated":"2025-05-30T11:13:13Z","snapshot_observed_at":"2026-08-17T11:46:18.301015Z","submitted_at":"2024-12-02T13:58:38Z","title":"Structured 3D Latents for Scalable and Versatile 3D Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01506","snapshot_observed_at":"2026-08-03T04:04:21.552169Z","title":"Structured 3d latents for scalable and versatile 3d gen- eration.arXiv preprint arXiv:2412.01506, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:21.552169Z"},"links":{"cited_paper":"/paper/2412.01506","citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:c23e8ce5ce52cf8c6e3cbdadb6e47f26c499aa95d6e3c48f7cccc23435dba0c7","observation_id":"bcc7a8fb-6665-486c-b4b4-bcdac00dd9d1","resolution":{"observed_at":"2026-08-03T04:04:21.552169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:21.589010Z","title":"Cpf: Learning a contact potential field to model the hand-object interaction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:21.589010Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:233fd2bcd93837e8aab8df061482b13c6809427beab145c493ce337278131c0b","observation_id":"3ae5673c-c700-412c-bd13-92a412b0accc","resolution":{"observed_at":"2026-08-03T04:04:21.589010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:21.669514Z","title":"Artiboost: Boosting articulated 3d hand-object pose estimation via online exploration and syn- thesis","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:21.669514Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:01725395b93ef14219e5a8fcc2cb2bbfbfd3bb45a098a1abf34b22fc948a6a6c","observation_id":"d756e8f8-4e26-462f-ae1e-8546cb9c71f0","resolution":{"observed_at":"2026-08-03T04:04:21.669514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:21.725035Z","title":"What’s in your hands? 3d reconstruction of generic objects in hands","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:21.725035Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:27d114ad926ebdd97a19735bc18dbfeaa5266c07e6943ad03b9f4157631308ac","observation_id":"6e3df808-4a18-4df1-8f60-db6fb68ec79c","resolution":{"observed_at":"2026-08-03T04:04:21.725035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:21.803022Z","title":"Diffusion-guided reconstruction of everyday hand- object interaction clips","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:21.803022Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:28e34427e75417a0ba2de4ef0c7e4dce12664d13d74d5f5de716c53cdbecced2","observation_id":"ff84b8d1-2e78-41da-94ab-da553945282b","resolution":{"observed_at":"2026-08-03T04:04:21.803022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:21.888823Z","title":"G-hop: Generative hand-object prior for interac- tion reconstruction and grasp synthesis","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:21.888823Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:fa1359e81da41961fca09e9146fe7d77676cc7eeced76f5c29c9e8ba408ab2a1","observation_id":"1017f8f1-a5c8-4b17-90b0-5219c8bf4124","resolution":{"observed_at":"2026-08-03T04:04:21.888823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08329","last_updated":"2025-01-14T18:59:05Z","snapshot_observed_at":"2026-08-16T12:58:57.381914Z","submitted_at":"2025-01-14T18:59:05Z","title":"Predicting 4D Hand Trajectory from Monocular Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08329","snapshot_observed_at":"2026-08-03T04:04:21.971197Z","title":"Predicting 4d hand trajectory from monocular videos.arXiv preprint arXiv:2501.08329,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:21.971197Z"},"links":{"cited_paper":"/paper/2501.08329","citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:681a556d931e94059c88df43214390723cfc3eca778281122eec5c226a848d6c","observation_id":"81a9e030-c7c4-4130-998a-cacd3abb3ffa","resolution":{"observed_at":"2026-08-03T04:04:21.971197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:22.043000Z","title":"Ddf-ho: Hand-held object reconstruction via conditional directed distance field","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:22.043000Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:3cbc8a10ee2d58d6d831de5252721060b49c2bdd2a6746ea7226114759183c1e","observation_id":"e43700c4-e01b-4738-86ef-109f942ec5d9","resolution":{"observed_at":"2026-08-03T04:04:22.043000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:22.097239Z","title":"GraspXL: Generating grasping motions for di- verse objects at scale","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:22.097239Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:81e4e51c5a7478c91d87ffade1fe10d4150bd5a1cfc3eb4737e9e9c4df1341b0","observation_id":"5c5933bf-df19-4764-b369-894a092e77e6","resolution":{"observed_at":"2026-08-03T04:04:22.097239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:22.205448Z","title":"ArtiGrasp: Physically plausible synthesis of bi-manual dexterous grasp- ing and articulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:22.205448Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:19efd17c50a0951909be2c79e37f3c2e8b865bd13218500b36a7e1dcde339932","observation_id":"720753ae-0804-49ac-9f0b-663d258ed13e","resolution":{"observed_at":"2026-08-03T04:04:22.205448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:04:22.256638Z","title":"Zhang, Sam Pepose, Hanbyul Joo, Deva Ra- manan, Jitendra Malik, and Angjoo Kanazawa","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-03T04:04:22.256638Z"},"links":{"citing_paper":"/paper/2602.06226"},"observation_digest":"sha256:2a99135508fc4480370f6554416749bca1d63d047a813c1ac1932910787d4706","observation_id":"6c4a9044-79f5-4cdc-9756-f6713f91aa6b","resolution":{"observed_at":"2026-08-03T04:04:22.256638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.06226","last_updated":"2026-06-20T15:04:24Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T18:56:00.909977Z","submitted_at":"2026-02-05T22:05:57Z","title":"ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":81,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 0 inbound Pith citation observations for arXiv:2602.06226."}