{"as_of":"2026-08-07T09:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2d5fed24d22d7e4c89bbada3d0f81dfe694b82a3b8ae7ebc28b60a79a694b67b","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T07:24:10.006783Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T01:23:06.611259Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.04672","snapshot_observed_at":"2026-07-31T08:51:22.298052Z","title":"Agile: Hand-object interaction re- construction from video via agentic generation.arXiv preprint arXiv:2602.04672, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28394","last_updated":"2026-08-01T08:11:08Z","snapshot_observed_at":"2026-08-06T23:11:29.841318Z","submitted_at":"2026-07-30T15:48:16Z","title":"Hand-Object Interaction in the Age of Large Foundation Models:Reconstruction, Generation, and Embodied Transfer","version":1},"reference_index":159,"source":"pdf_text","source_observed_at":"2026-07-31T08:51:22.298052Z"},"links":{"cited_paper":"/paper/2602.04672","citing_paper":"/paper/2607.28394"},"observation_digest":"sha256:adad7b9cf53db671dc71704d9b0e8655399dd72c3b5ba7ee998f242ab05408eb","observation_id":"e4b6c20e-dbdc-4740-8d85-0b7bcc9c5638","resolution":{"observed_at":"2026-07-31T08:51:22.298052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.04672","snapshot_observed_at":"2026-08-04T01:23:06.611259Z","title":"Agile: Hand-object interaction re- construction from video via agentic generation.arXiv preprint arXiv:2602.04672, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28394","last_updated":"2026-08-01T08:11:08Z","snapshot_observed_at":"2026-08-06T23:11:29.841318Z","submitted_at":"2026-07-30T15:48:16Z","title":"Hand-Object Interaction in the Age of Large Foundation Models:Reconstruction, Generation, and Embodied Transfer","version":2},"reference_index":152,"source":"pdf_text","source_observed_at":"2026-08-04T01:23:06.611259Z"},"links":{"cited_paper":"/paper/2602.04672","citing_paper":"/paper/2607.28394"},"observation_digest":"sha256:cef068cf546be1bc6d8e21ca00156a51b840b8f4d34b9f5350eeb6ba507022a6","observation_id":"c8c26691-124d-4c20-8376-80deacf480ff","resolution":{"observed_at":"2026-08-04T01:23:06.611259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2602.04672/citation-record","integrity":"/paper/2602.04672/integrity","json":"/paper/2602.04672/citation-record.json","paper":"/paper/2602.04672"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d hand shape and pose from images in the wild","venue":null,"work_id":"ad677883-6979-478e-989c-d83fd894e849","year":2019},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:86fa8afbad83ce9d0434bb86f29e40901fb8ea0b9763a4f85d746c6aabf9ddb0","observation_id":"40884cc0-2a9b-4769-a910-b9cff49f8785","resolution":{"observed_at":"2026-05-16T07:30:45.367676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dexycb: A benchmark for capturing hand grasping of objects","venue":null,"work_id":"14591d07-67b8-4df3-8a75-edeaa39be475","year":2021},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:cdb466bff81a33f45d10a5173f62a852d4df2eb570f445ff7aa811c7a99da7e2","observation_id":"b01c598d-b731-435e-aa97-0f0863de2307","resolution":{"observed_at":"2026-05-16T07:30:45.377323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The trimmed iterative closest point algorithm","venue":null,"work_id":"7d79c80c-2f35-47cc-914c-eb25809f68f9","year":2002},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:e8525b15328a06b252ac37fb657045f973244ce25b8fc8e1960e5cb17a10ca8a","observation_id":"80c3061b-2f1c-49ef-ba6a-5e3b12670404","resolution":{"observed_at":"2026-05-16T07:27:32.699254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:7537459f081c001748956fe1fbb606acbdbf8b4c8a729d9728617a8475cca90b","observation_id":"a1a026d8-6287-48d8-80ff-56ab85c2d5df","resolution":{"observed_at":"2026-05-16T07:27:31.715849Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ganhand: Predicting human grasp affordances in multi-object scenes","venue":null,"work_id":"84bb90c7-84da-4c3d-8387-d2e26712e215","year":2020},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:b2ed8f037bae5fa9541984d2f7c6fb67425ae6e1a59413017b7dfb7e923171db","observation_id":"1ee9a805-674c-4412-82fe-be5281cebfdd","resolution":{"observed_at":"2026-05-16T07:27:32.702600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Benchmarks and challenges in pose estimation for egocentric hand interactions with objects","venue":null,"work_id":"7b81ee6a-93ad-4a87-a87c-958a907b9d0f","year":2024},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:b83d21dc0c11ac61e881ade069920abcd95bb32075603b0c34803198bc0c8ca3","observation_id":"808fa467-da6e-4d8b-98a2-565e2f634b81","resolution":{"observed_at":"2026-05-16T07:30:45.379794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hold: Category-agnostic 3d reconstruction of in- teracting hands and objects from video","venue":null,"work_id":"d477b7fd-a874-4e88-a498-6af4db3a8f49","year":2024},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:305c7f2784cf25e9b94093bb2c4f92627112c1b8a29ce4f67287464025f66379","observation_id":"a8d7f85f-9927-4471-8846-3a9451e299ea","resolution":{"observed_at":"2026-05-16T07:30:45.382714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Honnotate: A method for 3d annotation of hand and object poses","venue":null,"work_id":"ca936f47-d0c5-437a-8e15-8e3a420433dd","year":2020},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:85ba480259292e2b14873d5a40baa2639cb829f515cc90fa46edb359a414c282","observation_id":"09cf530c-b258-40be-8806-20cca00e59e5","resolution":{"observed_at":"2026-05-16T07:30:45.374415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04400","last_updated":"2024-03-09T10:47:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-08T00:03:52Z","title":"LRM: Large Reconstruction Model for Single Image to 3D","version":2},"cited_work":{"arxiv_id":"2311.04400","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.04400","snapshot_observed_at":"2026-07-09T18:46:26.549595Z","title":"LRM: Large Reconstruction Model for Single Image to 3D","venue":"cs.CV","work_id":"0662dc2c-cc1c-4358-99bd-2a5f34795738","year":2023},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"cited_paper":"/paper/2311.04400","citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:da735b13016209b24814517c3bc29d8f5e5390283c2342121f46ac54ae36c117","observation_id":"9592eb7d-6051-41ba-b477-b8f79ed4ef46","resolution":{"observed_at":"2026-05-16T07:27:31.711731Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T07:46:04.037239Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM Trans","venue":null,"work_id":"f02b3a8e-cb41-4f1f-ae1c-75b487ba20f9","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:5eb45e74b6a27dd756ec9e0d80b068d9a5e1394c685a70922c20a1d4fcac4d19","observation_id":"cfac6b7f-75fd-4c9e-bcd6-6f0a664345ea","resolution":{"observed_at":"2026-05-16T07:30:45.385322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:25c8cf54735d16ac38cc686c9d299e2ac57e2982700e12cf067099c9f2c87943","observation_id":"21c4bc0e-a5ff-406d-ba83-bc746c06a6d2","resolution":{"observed_at":"2026-05-16T07:27:31.704177Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zero-1-to- 3: Zero-shot one image to 3d object","venue":null,"work_id":"54afcb51-c3bb-4817-ab98-9cb7d3bdcaa2","year":2023},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:4c1d7914f172bb76fdcb8728a2c90563872440c5c8734912924fc5c190a25c0e","observation_id":"5f0ba4d9-d04f-42f1-aa69-b92da19f563a","resolution":{"observed_at":"2026-05-16T07:27:32.661226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wonder3d: Sin- gle image to 3d using cross-domain diffusion","venue":null,"work_id":"7f7372ce-f2a9-411b-bea9-6f9c22e3db29","year":2024},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:df8e629de818bd6fdbb7763e75274d98d510ed3e101a84df03a10d10b9aa6254","observation_id":"95a5f8af-9502-4bb4-9085-3fc7836717ec","resolution":{"observed_at":"2026-05-16T07:27:32.652060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Isaac gym: High performance gpu-based physics sim- ulation for robot learning","venue":null,"work_id":"896ba339-9305-418f-ae08-f468a43aa925","year":2021},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:f998501b9f01757b96e60bef06d3042c914685c7bc444f384b7bf09039009412","observation_id":"a84e2128-5b95-48ec-a589-58c5dde91e0c","resolution":{"observed_at":"2026-05-16T07:27:32.655678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis.Communications of the ACM, 65(1):99–106","venue":null,"work_id":"3636ffa2-b06c-4e63-8205-b631ee117bfb","year":2021},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:d0b57079c1072d6297aacadded953aadbb6165597619a8184a4581f4816f2bff","observation_id":"a5bb3d14-b9bb-4f68-a9aa-706761800d4e","resolution":{"observed_at":"2026-05-16T07:27:32.645547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bigs: Bimanual category-agnostic interaction reconstruction from monocular videos via 3d gaussian splatting","venue":null,"work_id":"f2ca6bb9-42d8-4d28-8085-bc8fa123b983","year":2025},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:8b3c0cd0226b24cf23376cc1c0545d766fabef7a6ca6d1ee36e0edc3b6191757","observation_id":"14bf4131-1ce5-411c-9f05-70136576775b","resolution":{"observed_at":"2026-05-16T07:27:32.639203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recon- structing hands in 3d with transformers","venue":null,"work_id":"eb0c9ab4-9eea-4c8d-a0ff-dcc29222ec7a","year":2024},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:641a3ff1b53fb62f30ec88e5e86fe0779a5d95e1cd4b62ede093930c8065447f","observation_id":"0488a3fd-5574-4b28-ad25-5064ba2ed11d","resolution":{"observed_at":"2026-05-16T07:27:32.642112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wilor: End-to-end 3d hand localization and reconstruction in-the-wild","venue":null,"work_id":"c648607c-eb8c-4acd-830f-53c4efc7dda2","year":2025},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:5e501264177bd190085973babcf43091a95751c99ac9f4bbece7abd27a9a93b3","observation_id":"ada3c2ea-14f9-49ec-a884-9a4ecb509b85","resolution":{"observed_at":"2026-05-16T07:27:32.649012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Anyteleop: A general vision-based dexterous robot arm- hand teleoperation system","venue":null,"work_id":"1569739b-a3cf-4880-af5a-1a578ca09a2c","year":2023},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:d3700fb4e623d58dfdf788ff979db1c9cbd2c3f286077c449344ebcbf12caa47","observation_id":"e47c1146-9afa-4504-bb73-dba30941fc83","resolution":{"observed_at":"2026-05-16T07:27:32.664264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08501","last_updated":"2020-07-16T17:53:02Z","snapshot_observed_at":"2026-07-06T09:38:53.228850Z","submitted_at":"2020-07-16T17:53:02Z","title":"Accelerating 3D Deep Learning with PyTorch3D","version":1},"cited_work":{"arxiv_id":"2007.08501","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.08501","snapshot_observed_at":"2026-07-04T20:30:07.174987Z","title":"Accelerating 3D Deep Learning with PyTorch3D","venue":"cs.CV","work_id":"28c48e8f-4d02-49fb-9564-fa686720784e","year":2020},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"cited_paper":"/paper/2007.08501","citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:9539491b9f59e046341b31ef33d6d78c6e14c1a7f24e8f5529afa4a9e2d5f26d","observation_id":"43479813-e876-4295-a0ea-89128e40fd7e","resolution":{"observed_at":"2026-05-16T07:27:31.708079Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":"2408.00714","doi":"10.1038/s41598-025-97590-3","metadata_source":"pith","pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 2: Segment Anything in Images and Videos","venue":"cs.CV","work_id":"acc13f66-d814-44f9-9688-375688bf2d4a","year":2024},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:d5ca6787897a0c78e0bc85256492fd867dfe53f9dbbd9001c1c20f5e742a6503","observation_id":"0fdf5112-b6ab-4053-84f1-74c7f2da234f","resolution":{"observed_at":"2026-05-16T07:27:31.692220Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T04:24:23.885301+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T04:24:23.885301+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.02610","last_updated":"2022-01-07T18:59:32Z","snapshot_observed_at":"2026-08-03T16:58:59.798412Z","submitted_at":"2022-01-07T18:59:32Z","title":"Embodied Hands: Modeling and Capturing Hands and Bodies Together","version":1},"cited_work":{"arxiv_id":"2201.02610","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2201.02610","snapshot_observed_at":"2026-07-04T09:39:46.884388Z","title":"Em- bodied hands: Modeling and capturing hands and bodies to- gether","venue":null,"work_id":"82cb27bc-fcfa-4002-b59a-ec2d3366a168","year":2022},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"cited_paper":"/paper/2201.02610","citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:6a9a123b42fcb63f68ab5a15538a225195c274243d42a9e5a650561ca75d673b","observation_id":"02c4d03b-8976-4861-b2c9-7f1d9b4b2ef2","resolution":{"observed_at":"2026-05-16T07:27:31.696765Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Structure-from-motion revisited","venue":null,"work_id":"205559ba-882c-4454-b5bf-dc3b8df2fd0c","year":2016},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:964b95fb036a377abe1ddc3ab6a797fa58315e26934a5e99be129240dd0945a1","observation_id":"e6a15972-1601-4a83-b515-69f90695d0de","resolution":{"observed_at":"2026-05-16T07:30:45.408888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"85810bd3-cd07-49d9-886f-531e34b94bef","year":2025},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:35f5b3b9043c34aad4ac14a817586f5aadd3c1a505a64cba0279c66c3f5db1ba","observation_id":"e50add39-83a2-41f5-9eab-498ddbff3c89","resolution":{"observed_at":"2026-05-16T07:30:45.387864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lgm: Large multi-view gaussian model for high-resolution 3d content creation","venue":null,"work_id":"3f0487db-3aa8-45b3-9c00-8584e99771bf","year":2024},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:733c305b610230468429f93cba1f36288dbe271dd6d6d4c1f4041a87acf7bb7e","observation_id":"4df24bc5-24c8-46ab-b928-9ac76189bfad","resolution":{"observed_at":"2026-05-16T07:30:45.397493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sam 3d: 3dfy anything in images","venue":null,"work_id":"f206e586-f141-4553-8a7d-5acdbdbb4175","year":2025},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:2c73b8c79f33899f274a2a9393fbce464019132ac0350dcb7da612b7e7989005","observation_id":"50ecfa5d-3c48-4bab-829c-768285ecc585","resolution":{"observed_at":"2026-05-16T07:30:45.353499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hunyuan3d 2.0: Scaling diffu- sion models for high resolution textured 3d assets generation","venue":null,"work_id":"41b26519-cf4e-43e0-b861-f886b638e544","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:76a3f7e6d8d5a55504abc04e76c2f345bc5b87691bfe025a432d7efec30b53e0","observation_id":"d6fb7603-64d5-4fd5-b5f5-7249fa34f0c0","resolution":{"observed_at":"2026-05-16T07:30:45.360381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hunyuan3d 2.5: Towards high- fidelity 3d assets generation with ultimate details","venue":null,"work_id":"a047796d-7102-47aa-9a83-dc915dd6bfba","year":2025},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:0bd2e5dad57114515f1a964d6372200ac72c6decb45053987b2fba19b5c1deb1","observation_id":"1db998fd-6219-4b3b-9a91-608371411752","resolution":{"observed_at":"2026-05-16T07:30:45.347613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"H+ o: Uni- fied egocentric recognition of 3d hand-object poses and in- teractions","venue":null,"work_id":"a64ac4bb-952b-461c-bc1b-3b2290f15375","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:0c9570cba7f0e5811d755efd8b9f8aafcec8c2331ee7baa1e315ad5ae2fa4e17","observation_id":"7fc0e863-a0b1-4724-a7df-7d02648e59b9","resolution":{"observed_at":"2026-05-16T07:30:45.400567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Moge: Unlocking accurate monocular geometry estimation for open-domain images with optimal training supervision","venue":null,"work_id":"e9a2a39b-a38b-43ee-9f5c-2dc35ea83095","year":2025},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:5a72f6df7d459028fd5d5839e5394ffa1b6c9b039240152b022039e2087df021","observation_id":"c8f157ad-751f-4dab-9512-4b0b3ca94aea","resolution":{"observed_at":"2026-05-16T07:27:32.689777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Magichoi: Leveraging 3d priors for accurate hand-object reconstruction from short monocu- lar video clips","venue":null,"work_id":"313cc4f4-baa8-4ffe-be8a-ac8fa6b2d46e","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:690a643dc1d678f019bc8165257f38112a20a6754d458b744ef1d89b1e314755","observation_id":"ebbca1c2-e0d0-4143-83c8-ad20da5b1845","resolution":{"observed_at":"2026-05-16T07:27:32.687015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Foundationpose: Unified 6d pose estimation and tracking of novel objects","venue":null,"work_id":"55648c10-0fdf-46bf-bd73-fa178fee67ca","year":2024},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:3845144b4d0046394db07273095fb5bb4d9c797b3ea838deec245ca3d8d83cfb","observation_id":"0a72e392-2942-4090-baa7-c763df63c657","resolution":{"observed_at":"2026-05-16T07:27:32.692610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07191","last_updated":"2024-04-14T16:54:24Z","snapshot_observed_at":"2026-07-06T17:58:25.894552Z","submitted_at":"2024-04-10T17:48:37Z","title":"InstantMesh: Efficient 3D Mesh Generation from a Single Image with Sparse-view Large Reconstruction Models","version":2},"cited_work":{"arxiv_id":"2404.07191","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.07191","snapshot_observed_at":"2026-07-08T01:44:26.212652Z","title":"InstantMesh: Efficient 3D Mesh Generation from a Single Image with Sparse-view Large Reconstruction Models","venue":"cs.CV","work_id":"fc55eabb-0871-4dc4-8bab-b572e0d2aac4","year":2024},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"cited_paper":"/paper/2404.07191","citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:880e661445cb8092b017f95e7bfcb57c232b28abec4f6ef26a571f79d8deffa4","observation_id":"831dc1f2-9c8b-4046-8b33-401ae7ffb4db","resolution":{"observed_at":"2026-05-16T07:27:31.699996Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cpf: Learning a contact potential field to model the hand-object interaction","venue":null,"work_id":"d0ca67cf-dd8f-49fc-b591-9fca0df2292e","year":2021},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:32aae7d32f2b3bb0323707f062e9e0a34cb33cbeac8e9088acdd4b6461d1d59a","observation_id":"768de590-5729-44ac-9888-6d5efaf47603","resolution":{"observed_at":"2026-05-16T07:27:32.681166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dyn- hamr: Recovering 4d interacting hand motion from a dy- namic camera","venue":null,"work_id":"fb695494-d675-4806-93d3-d8f085843fc2","year":2025},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:12591f691893fafbb517c8258ca13e1acddd55d560dcd6e841fd68e87e7c9050","observation_id":"38bb7712-a072-4728-97fa-5607a08f50fe","resolution":{"observed_at":"2026-05-16T07:27:32.684146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hawor: World-space hand motion reconstruction from egocentric videos","venue":null,"work_id":"f42da3f1-bb70-4918-94f9-f7a3d3747f3f","year":2025},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:97723f85ad22be838e403173319e018038c6943eb7d06750a2f010c8af9f6479","observation_id":"55b158d4-8107-4f4b-bfa0-d67ad78f5897","resolution":{"observed_at":"2026-05-16T07:27:32.695988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"End-to-end hand mesh recovery from a monocular rgb image","venue":null,"work_id":"c0e386b1-9b44-410f-bace-13bf3b06cb88","year":2019},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:d2188e6ef1912b0ef0a73bcb8c6dfa33a55aab18319fe6d4d24c527ae5b8212d","observation_id":"b7ac22b6-528c-482b-9f9a-fbf6ca457647","resolution":{"observed_at":"2026-05-16T07:30:45.403438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Monocular real- time hand shape and motion capture using multi-modal data","venue":null,"work_id":"14b0cdc6-7b9d-47b8-83e6-dec597d0fa1b","year":2020},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:c380f8cf8e8112af18c07c0a4f0aab840d2296e7b27ff16c9e6578d1755d75fe","observation_id":"7b68bb1f-6ae2-4e6f-b075-2e26637f441b","resolution":{"observed_at":"2026-05-16T07:30:45.406141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Crucially, we utilizeGemini 3 Pro[4] as the VLM agent responsi- ble for keyframe selection and rigorous quality assess- ment","venue":null,"work_id":"b10c474e-59b1-40bc-817f-f8bbabb4dcce","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:da0dcaaf17865d599bd76440ae9f1b7729c3d8d8fe2d40fb92abc71ae577fdf9","observation_id":"85bb772e-d1f0-4d46-a24c-57e798190078","resolution":{"observed_at":"2026-05-16T07:30:45.338610Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a4285bf1-a52d-4c0d-9605-6a5a9a06950a","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:082895eefd5ba889d4494c95c639dfc761988372bf96e7892005932d90396fdd","observation_id":"48361087-6cad-467c-b1f0-ecd04fb65983","resolution":{"observed_at":"2026-05-16T07:27:32.667231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"11785f4a-e44e-44cd-becf-dbdf05d7cd81","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:9b6ed85b8086596810542c58d212789f73afbb1117eff0c738108801bf0b9720","observation_id":"38072a87-ee92-4b0e-8f71-4f887062dd15","resolution":{"observed_at":"2026-05-16T07:27:32.669840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7cffccfa-8706-41d8-a540-701c16e064cc","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:e1f9f386689a1d238ba00526e755a594fbd46e31f86d120ec96346c0b8963603","observation_id":"8d77245e-6501-4e08-807c-1bfca7a94756","resolution":{"observed_at":"2026-05-16T07:27:32.675493Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"As shown in Table 5, texture quality plays a decisive role in the performance of the subsequent pose estimation","venue":null,"work_id":"6fcea99b-4d4b-4577-9d45-bddfaea967bd","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:6719d51951e7c7d2e2be48eee1d5bbf9e939ece170040edaddfc9f68c9bd7b59","observation_id":"bab2f803-f7bc-4dba-b51d-6cd40df00442","resolution":{"observed_at":"2026-05-16T07:27:32.678181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Experimental Setup.Given that SAM3D operates on a single-frame basis, we evaluate it on every5 th frame across all 18 scenes in the HO3D dataset","venue":null,"work_id":"bf66400e-8b08-428c-aac8-c2dd3defeffe","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:284727cac93394a8f371863052f764ce4dd6ec61e391a0eb7ff21881f1a4f89b","observation_id":"43676baf-ef47-4cbc-972c-58e759b942cb","resolution":{"observed_at":"2026-05-16T07:27:32.672899Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On a single NVIDIA RTX 4090 GPU, each frame requires ap- proximately 30–50 seconds for optimization","venue":null,"work_id":"82c81a0a-f8da-4eaa-829c-dec4ca093032","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:4d824ad6265aec23e866630abc2bca95cff8541a69c4c7ad8532949ca5f85ecb","observation_id":"e865d7de-4e2f-4a12-89a2-5f767ca64108","resolution":{"observed_at":"2026-05-16T07:30:45.344541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"system_role","venue":null,"work_id":"9882ab52-fa54-4381-a26c-914d1d9ef537","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:d3db11be81abeb225f540eb5f85b70b4ca39b16c6c9b4c806c942495dd7113cb","observation_id":"f8ec70c9-4429-4dfa-9835-236c0926c091","resolution":{"observed_at":"2026-05-16T07:30:45.327959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"73b1fdf2-6c80-4d67-85fc-4a3358bafdc4","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:abbc7b8e10bf6ec209557d391d24db7d6d70133861e1693bf5af168e5021909b","observation_id":"2597e986-0070-4a37-8a95-13ff4fa81f46","resolution":{"observed_at":"2026-05-16T07:30:45.335901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1d383e4d-296e-45a2-a6ea-f37142180228","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:0528caaf5052e05f0065b5eb55530c1c400a22e80730731a124601a63d49107c","observation_id":"b6ada6ec-7102-40f9-982a-8dc1083bf66a","resolution":{"observed_at":"2026-05-16T07:30:45.331540Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9707e04d-69a4-4f9b-a44b-7c6e93a64457","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:a76bf5e067f422e38d5575630a016f8cfa5de40996fcbd291234656c5999bd5f","observation_id":"44e31ade-1331-489c-a4f6-2a1e7d9a7454","resolution":{"observed_at":"2026-05-16T07:30:45.308536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f119f1e8-df65-4f02-ab33-55e3095e3bc7","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:f48e5b77c371bcba9bf117e63de04ffe18dbc6b88c391ebf643a20178ba12abb","observation_id":"66fd2cfa-4a59-4777-a069-e22ef62bb8b0","resolution":{"observed_at":"2026-05-16T07:30:45.313744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"9\"response_format","venue":null,"work_id":"af25c4bb-c9bb-4b8b-86aa-3ed0d366a05b","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:0da56374c61f47fbfebd5768312bdd1cd6f6c974a69df451837182fd5099e50e","observation_id":"d885cc10-da39-4e7c-a492-d87256b167d4","resolution":{"observed_at":"2026-05-16T07:30:45.305191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f68d00c4-edbd-49d9-9c92-61a7da4a02d8","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:a7e423b1c743afc914c61a5dd4e5798baf669a765e0dfae40fcb97a78d9ae1d3","observation_id":"10d04093-3b3e-4059-948c-c6a339d08def","resolution":{"observed_at":"2026-05-16T07:27:32.658084Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"7\"evaluation_criteria","venue":null,"work_id":"7b17e5b4-98a0-40bf-a2de-3959a36665a3","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:ba14ad4fb0a5b8f1d0d368b2424029d5015def0902a2233d1cce5d68365ec9f8","observation_id":"48cfe070-fd7e-4cc3-aed9-bc4c87b084b4","resolution":{"observed_at":"2026-05-16T07:30:45.310895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"11 12Level 2: Core Dimension Scoring (0-10)","venue":null,"work_id":"1a253f48-c845-466b-8fbd-09f00855f6f3","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:6372b8524e1b81c236904e28a7909458f9abb87ff391a8c6300ab3ff9e2bad06","observation_id":"cd5765d6-5309-49a5-bc54-c48433233f84","resolution":{"observed_at":"2026-05-16T07:30:45.316592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c382e660-c7b2-4db0-8717-922ebdb9ee28","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:b671e9971c24711a1199fb54fff8fe5a8185fa205ed924b3c703f5152d3600f0","observation_id":"f23d9bca-ceb2-4b06-9267-79ef958b2e16","resolution":{"observed_at":"2026-05-16T07:30:45.322571Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c8b938d4-7eed-49fc-b491-d11f68361bef","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:c1e9222d8414ca38713d78f1c9dbbdc5313bdb07c00e038c12406c2802e04e21","observation_id":"d0d13129-0353-49d2-9cad-58827970e32c","resolution":{"observed_at":"2026-05-16T07:30:45.350510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"24f52ee9-0adb-40d3-be38-e6ab1cd1acfa","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:b0524c354e79447a37afc79663862237f88ce01fac9123110efe466c682414f4","observation_id":"dd38ab87-1d0a-4e34-abb6-a7824929862d","resolution":{"observed_at":"2026-05-16T07:30:45.365186Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5f8b71aa-28ba-484d-bb46-acfcb313ca97","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:8f9db100aebcfa68cdebb3f6a9cd324f34c1c32ef01e7ba1684f903d111f96fd","observation_id":"40a67b61-9b20-468a-b004-e1e34c027158","resolution":{"observed_at":"2026-05-16T07:30:45.341627Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"22\"response_format","venue":null,"work_id":"0b3e279f-9417-435d-b18e-800511d35924","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:aa3495cad9b3665fc50b395e186ff57306d9395fe877f4b79de4a76bed77a893","observation_id":"f811920a-2a64-4ef0-a62b-3013f8aa5d3e","resolution":{"observed_at":"2026-05-16T07:30:45.356694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"563b94a2-2395-45f3-a2d6-bdd8fa8beab2","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:f1b1410307c42960ee378fc86fcf89891a8dcc0972a22c0516bb2efaf80d100f","observation_id":"b6fa653e-4afe-419d-a5c2-41cb8079de11","resolution":{"observed_at":"2026-05-16T07:30:45.325019Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b1b95b63-13aa-414a-9dbc-7a5b8e98c68d","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:0b12d7baae5db260b99434a2fc6f06971de13c93fa19dd688b8cd4635353d2ec","observation_id":"a80bdfff-28f3-42e1-8ac6-355a46efcdd9","resolution":{"observed_at":"2026-05-16T07:30:45.333449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"8\"evaluation_criteria","venue":null,"work_id":"b4d9a1f7-5fac-4175-8df3-5d3f521abf28","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:e09618f9610deac99983fa94f23117393f9457310f17a1e9b8c78e3da2f4a0a7","observation_id":"85cc35d5-7d52-4c00-b203-e09e86cf1bb2","resolution":{"observed_at":"2026-05-16T07:30:45.330755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2e81996a-c928-4a16-b8c6-2f4d09d80600","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:1edaf20a63ec553035a2f1678973261ff7c25dd8f3c6076ef2fbd44a7a7dea60","observation_id":"7eb57823-a0dd-457b-923a-ac06376a0abb","resolution":{"observed_at":"2026-05-16T07:30:45.362877Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"64939c77-0e63-4bd6-9145-e3c38c6669de","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:10af2e570166b7379e7874a1e4f8869bf385e6134c0f2b47121b12ccd22a02d7","observation_id":"b6d0a4b6-b773-413c-acc4-b1707708d460","resolution":{"observed_at":"2026-05-16T07:30:45.411501Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"52e5b736-385e-434f-b2dc-0e08e460ce25","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:d8a993a83cde280275be2e94a24b027614310c21d16e19afea3ddd81ffe627d7","observation_id":"190ef1b1-ea4e-4a90-bda0-8d27d416f9b9","resolution":{"observed_at":"2026-05-16T07:30:45.390653Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"984e2fb4-b967-49c4-8eef-ab89ee4f3707","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:0f0689d7545a54b319bc0e5e8dd0b9866be8d894251bc3eff1bf9853bd98996d","observation_id":"26ec74a9-3eca-465a-b688-fbe60b45f71f","resolution":{"observed_at":"2026-05-16T07:30:45.369976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"23\"response_format","venue":null,"work_id":"abc7a974-9a49-41b7-ab42-1848306ac4de","year":null},"citing_paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-16T07:24:10.006783Z"},"links":{"citing_paper":"/paper/2602.04672"},"observation_digest":"sha256:24810b9cd5b36539fc0ee878560c56f5fa4cd380645324e9220dd7c63d6c36ff","observation_id":"560a9367-4a70-4a97-b4b1-dc1057f6f0ad","resolution":{"observed_at":"2026-05-16T07:30:45.372074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2602.04672","last_updated":"2026-05-08T05:34:48Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:44:33.166340Z","submitted_at":"2026-02-04T15:42:58Z","title":"AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":7,"verified_fuzzy":39},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 2 inbound Pith citation observations for arXiv:2602.04672."}