{"as_of":"2026-08-06T07:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2b51b7504d42d48c59ed584fc7ae6e23fdf8d0b9939c62a0cf4ecf5b8c1b464d","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-11T11:47:11.554134Z","state":"measured"},{"denominator":156,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":156,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":144,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T05:52:28.350825Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2601.11109","last_updated":"2026-04-06T13:27:26Z","snapshot_observed_at":"2026-07-06T22:41:53.823272Z","submitted_at":"2026-01-16T09:11:55Z","title":"Vision-as-Inverse-Graphics Agent via Interleaved Multimodal Reasoning","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-16T13:50:19.988813Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2601.11109"},"observation_digest":"sha256:f9e22f904ec1f4d00b77aa334d41a9ed95d6f3307730e6c5c3f54b61cb0f6374","observation_id":"6e5053e8-0703-41f2-8bac-514772dd65a9","resolution":{"observed_at":"2026-05-16T13:51:00.584496Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-03T04:22:47.542033Z","title":"J., Sax, A., Tang, H., Wang, W., Guo, M., Hardin, T., Li, X., et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05293","last_updated":"2026-06-01T08:31:02Z","snapshot_observed_at":"2026-08-04T22:42:43.325301Z","submitted_at":"2026-02-05T04:27:59Z","title":"Fast-SAM3D: 3Dfy Anything in Images but Faster","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T04:22:47.542033Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2602.05293"},"observation_digest":"sha256:8aa968f5a01196fa01bc8487c9fd808a11b2b1e86dcf76eb317e610109f1a03f","observation_id":"bc676d1c-f9dc-4a2b-8af9-ad628c13d30f","resolution":{"observed_at":"2026-08-03T04:22:47.542033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2602.08058","last_updated":"2026-07-28T15:19:46Z","snapshot_observed_at":"2026-08-03T03:27:32.091478Z","submitted_at":"2026-02-08T17:04:54Z","title":"Picasso: Holistic Scene Reconstruction with Physics-Constrained Sampling","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T05:55:19.254383Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2602.08058"},"observation_digest":"sha256:40e696ed38cecb4694e29ee9860dad342b65be7d9abb8276795abfcf25119f6e","observation_id":"bbb137d5-bb76-4eb6-8ef1-3bda924989d9","resolution":{"observed_at":"2026-05-16T05:57:24.477282Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-03T03:27:33.365716Z","title":"Sam 3d: 3dfy anything in images.arXiv preprint arXiv:2511.16624, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08058","last_updated":"2026-07-28T15:19:46Z","snapshot_observed_at":"2026-08-03T03:27:32.091478Z","submitted_at":"2026-02-08T17:04:54Z","title":"Picasso: Holistic Scene Reconstruction with Physics-Constrained Sampling","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:33.365716Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2602.08058"},"observation_digest":"sha256:7951b22b0b67e2200d128c96244305730a1343ad100c3a83125e4ab0c72334a7","observation_id":"cad98489-19b0-46a7-9f12-aacce8d4ac9a","resolution":{"observed_at":"2026-08-03T03:27:33.365716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2602.09023","last_updated":"2026-05-19T02:18:04Z","snapshot_observed_at":"2026-08-02T13:36:40.045905Z","submitted_at":"2026-02-09T18:59:52Z","title":"TwinRL: Digital Twin-Driven Reinforcement Learning for Real-World Robotic Manipulation","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T13:13:53.818915Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2602.09023"},"observation_digest":"sha256:af331883582018a04163acdb20e029acd1403575274e474cd24aec43da5b4814","observation_id":"fa3ae497-93fe-4e56-8a29-19cc82b14957","resolution":{"observed_at":"2026-05-21T13:14:10.894630Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2602.12633","last_updated":"2026-05-17T06:16:05Z","snapshot_observed_at":"2026-08-02T23:24:15.523206Z","submitted_at":"2026-02-13T05:24:58Z","title":"Real-to-Sim for Highly Cluttered Environments via Physics-Consistent Inter-Object Reasoning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T13:10:58.207515Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2602.12633"},"observation_digest":"sha256:ac41a0b12f79676a8d325a4c9f892143c4a553d215dfec036448205d886b4a13","observation_id":"a40e4a07-9077-40f5-adc3-d346933d8666","resolution":{"observed_at":"2026-05-21T13:14:11.185694Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2602.20150","last_updated":"2026-05-13T03:42:01Z","snapshot_observed_at":"2026-07-06T22:46:49.536946Z","submitted_at":"2026-02-23T18:58:24Z","title":"Simulation-Ready Cluttered Scene Estimation via Physics-aware Joint Shape and Pose Optimization","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T20:14:58.071349Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2602.20150"},"observation_digest":"sha256:0fb2eece3267a1e8cba9f1b280fb6e6ffb563de0c1c4afdbd9d096c79419bf8a","observation_id":"71651f40-5b5b-479d-ac28-d1d95d9f594c","resolution":{"observed_at":"2026-05-15T20:16:34.028935Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-07-15T14:36:31.220132Z","title":"J., Sax, A., Tang, H., Wang, W., Guo, M., Hardin, T., Li, X., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.05425","last_updated":"2026-05-27T15:11:58Z","snapshot_observed_at":"2026-07-30T08:29:32.410469Z","submitted_at":"2026-03-05T17:45:47Z","title":"RelaxFlow: Text-Driven Amodal 3D Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-15T14:36:31.220132Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2603.05425"},"observation_digest":"sha256:3c025ae36a7a95363efb47e6b28f7b3722dc803a56c1a677c648f5e63c33bcec","observation_id":"a4dc97c2-7475-4575-b479-40cfa9e2f1cb","resolution":{"observed_at":"2026-07-15T14:36:31.220132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-07-15T12:59:26.784081Z","title":"Sam 3d: 3dfy anything in images,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.07875","last_updated":"2026-07-07T10:51:40Z","snapshot_observed_at":"2026-07-15T12:59:26.567638Z","submitted_at":"2026-03-09T01:21:26Z","title":"Choose What to Observe: Task-Aware Semantic-Geometric Representations for Visuomotor Policy","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-15T12:59:26.784081Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2603.07875"},"observation_digest":"sha256:86520b6aac28058fa509a5a8e2830c381a27a485bee357e4bb316a83dd3c9535","observation_id":"35ed6235-e56c-47df-b90c-f0d33fb22daa","resolution":{"observed_at":"2026-07-15T12:59:26.784081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-02T18:31:43.855800Z","title":"SAM 3D: 3dfy anything in images.arXiv preprint arXiv:2511.16624, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.09971","last_updated":"2026-07-28T19:12:58Z","snapshot_observed_at":"2026-08-04T15:14:09.655279Z","submitted_at":"2026-03-10T17:59:00Z","title":"TiPToP: A Modular Open-Vocabulary Robot Manipulation System That Plans","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T18:31:43.855800Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2603.09971"},"observation_digest":"sha256:5cd9e34a2333197e9e79227c38a30aad8697a8d46bbf1bd27097648ca81b5d42","observation_id":"a3c2e417-4406-4650-b161-d34085a82592","resolution":{"observed_at":"2026-08-02T18:31:43.855800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2603.11633","last_updated":"2026-04-09T09:02:54Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T07:53:35Z","title":"MV-SAM3D: Adaptive Multi-View Fusion for Layout-Aware 3D Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T12:59:47.236252Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2603.11633"},"observation_digest":"sha256:073c3be097ddb0779a7f855b8d869d86c1063797461f1d6470c80e52be98a13a","observation_id":"92977c62-9a04-4502-b663-33b7cdfdc6bf","resolution":{"observed_at":"2026-05-15T13:00:00.540650Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-02T18:24:38.231546Z","title":"SAM 3D: 3Dfy Anything in Images,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.11655","last_updated":"2026-08-03T00:05:32Z","snapshot_observed_at":"2026-08-06T07:12:06.883202Z","submitted_at":"2026-03-12T08:25:21Z","title":"Concurrent Prehensile and Nonprehensile Manipulation: A Practical Approach to Multi-Stage Dexterous Tasks","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T18:24:38.231546Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2603.11655"},"observation_digest":"sha256:9bbe814f86e5cb682711c254cad933a6e544f93f6098a86d4778d3a877929e6c","observation_id":"70b16d1c-2ac2-462d-8970-92ea6c670746","resolution":{"observed_at":"2026-08-02T18:24:38.231546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-04T05:52:28.350825Z","title":"SAM 3D: 3Dfy Anything in Images,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.11655","last_updated":"2026-08-03T00:05:32Z","snapshot_observed_at":"2026-08-06T07:12:06.883202Z","submitted_at":"2026-03-12T08:25:21Z","title":"Concurrent Prehensile and Nonprehensile Manipulation: A Practical Approach to Multi-Stage Dexterous Tasks","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T05:52:28.350825Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2603.11655"},"observation_digest":"sha256:5e800997ce18fa8154a5161259f15219f028faa3ae08c76fe27ec09288009a0b","observation_id":"178a4370-e24c-48fe-b547-a4aa17a603d8","resolution":{"observed_at":"2026-08-04T05:52:28.350825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-02T17:44:42.826560Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.21618","last_updated":"2026-07-22T05:16:36Z","snapshot_observed_at":"2026-08-02T17:44:39.319473Z","submitted_at":"2026-03-23T06:30:46Z","title":"4DGS360: 360{\\deg} Gaussian Reconstruction of Dynamic Objects from a Single Video","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T17:44:42.826560Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2603.21618"},"observation_digest":"sha256:75c5eba066489c5cee77f51f607bf6c213126006fcd384ac9904935fee9719fa","observation_id":"b2d1f7f6-63ff-4ed2-9601-a15ad38c52a4","resolution":{"observed_at":"2026-08-02T17:44:42.826560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-07-13T18:05:58.357155Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.25726","last_updated":"2026-06-05T20:32:54Z","snapshot_observed_at":"2026-08-06T06:19:16.284547Z","submitted_at":"2026-03-26T17:58:54Z","title":"AnyHand: A Large-Scale Synthetic Dataset for RGB(-D) Hand Pose Estimation","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-13T18:05:58.357155Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2603.25726"},"observation_digest":"sha256:48aecdbdaf4b2089c8a38baca718c32a69fd956d00f318fa5f76f3a85c890a40","observation_id":"6f2ca248-f374-48f4-a0d7-a272bf31e711","resolution":{"observed_at":"2026-07-13T18:05:58.357155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-03T02:31:03.068851Z","title":"arXiv preprint arXiv:2511.16624 (2025) 5","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.01207","last_updated":"2026-07-31T06:47:55Z","snapshot_observed_at":"2026-08-05T23:10:26.447101Z","submitted_at":"2026-04-01T17:51:00Z","title":"TRACE: High-Fidelity 3D Scene Editing via Tangible Reconstruction and Geometry-Aligned Contextual Video Masking","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-03T02:31:03.068851Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.01207"},"observation_digest":"sha256:319b356da2084e04a6296aa073d31b6bff00b3b966124726ffc38aa176cfe108","observation_id":"05847f3a-67fc-41df-a91a-e23dad53b599","resolution":{"observed_at":"2026-08-03T02:31:03.068851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.01479","last_updated":"2026-04-03T02:02:55Z","snapshot_observed_at":"2026-07-06T22:51:35.522923Z","submitted_at":"2026-04-01T23:35:40Z","title":"UniRecGen: Unifying Multi-View 3D Reconstruction and Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T22:12:52.334139Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.01479"},"observation_digest":"sha256:04ae21e7cafbfb54790151f5bb940f5d9832dd5a0e877b4825e2b798e8322ee9","observation_id":"9dc8c09a-5bb5-48ed-89d3-888a53445468","resolution":{"observed_at":"2026-05-13T22:13:20.854134Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.02736","last_updated":"2026-04-13T01:15:15Z","snapshot_observed_at":"2026-07-06T22:52:02.162758Z","submitted_at":"2026-04-03T05:17:12Z","title":"THOM: Generating Physically Plausible Hand-Object Meshes From Text","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T20:43:52.218942Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.02736"},"observation_digest":"sha256:caf55a85c742d6461ea55564dbc8968fe0ca0c569df195944b81a8c9ab60ceff","observation_id":"626bbd03-ba09-4a3d-a79b-62db2e2652c0","resolution":{"observed_at":"2026-05-13T20:48:15.738012Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.05182","last_updated":"2026-07-22T21:33:06Z","snapshot_observed_at":"2026-08-02T16:46:05.370757Z","submitted_at":"2026-04-06T21:21:12Z","title":"LSRM: High-Fidelity Object-Centric Reconstruction via Scaled Context Windows","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T19:32:20.565326Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.05182"},"observation_digest":"sha256:021d36d195da4ed6c3e10fc92610dbc8df829bb7d3aa67d60f671b1fe96fde9f","observation_id":"88b76817-4d64-420e-85eb-53d30b4b03e7","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-07-13T09:33:39.204257Z","title":"arXiv preprint arXiv:2511.16624 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.05182","last_updated":"2026-07-22T21:33:06Z","snapshot_observed_at":"2026-08-02T16:46:05.370757Z","submitted_at":"2026-04-06T21:21:12Z","title":"LSRM: High-Fidelity Object-Centric Reconstruction via Scaled Context Windows","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T09:33:39.204257Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.05182"},"observation_digest":"sha256:e99c4afc1af21b814202b7158453314a70e5c612d6d6038eb0e23d7e887a4ef5","observation_id":"b0756077-c7b9-44d2-9d61-9172f2046f0b","resolution":{"observed_at":"2026-07-13T09:33:39.204257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-02T16:46:06.428974Z","title":"arXiv preprint arXiv:2511.16624 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.05182","last_updated":"2026-07-22T21:33:06Z","snapshot_observed_at":"2026-08-02T16:46:05.370757Z","submitted_at":"2026-04-06T21:21:12Z","title":"LSRM: High-Fidelity Object-Centric Reconstruction via Scaled Context Windows","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T16:46:06.428974Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.05182"},"observation_digest":"sha256:ef8699d05e7e05416f7916d369dd8b36e4a3208e0fe9f9258e2696c2f1bba758","observation_id":"572899c5-ff6c-4a46-a0f4-a5de4a3ed195","resolution":{"observed_at":"2026-08-02T16:46:06.428974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.05212","last_updated":"2026-04-06T22:18:02Z","snapshot_observed_at":"2026-08-02T06:06:03.748693Z","submitted_at":"2026-04-06T22:18:02Z","title":"Boxer: Robust Lifting of Open-World 2D Bounding Boxes to 3D","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T19:14:24.020697Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.05212"},"observation_digest":"sha256:eccfabbd59f8f093f7b2d9a139258470ae9b2016657063abe684106ebbeab17f","observation_id":"562bcac1-d139-41c8-a490-deb74f22d170","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.06725","last_updated":"2026-04-08T06:47:55Z","snapshot_observed_at":"2026-08-02T13:53:46.692069Z","submitted_at":"2026-04-08T06:47:55Z","title":"Enhancing MLLM Spatial Understanding via Active 3D Scene Exploration for Multi-Perspective Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T19:16:46.753641Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.06725"},"observation_digest":"sha256:63ed48ced3db20a72d4419ef2c24ec4960c93f5579655a221b497a49239fd5d0","observation_id":"32a30090-ed24-40ca-a494-19eaca93310d","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.06773","last_updated":"2026-04-08T07:41:28Z","snapshot_observed_at":"2026-07-06T22:55:11.560398Z","submitted_at":"2026-04-08T07:41:28Z","title":"MemoryDiorama: Generating Dynamic 3D Diorama from Everyday Photos for Memory Recall","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T18:34:31.489505Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.06773"},"observation_digest":"sha256:6791eae854df17e6669cff44ca880d11c6488218b24f82cf6869663c4de2a1ed","observation_id":"5ed88d83-27d7-4ff2-b5d2-0918c54add62","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.07230","last_updated":"2026-04-09T11:01:59Z","snapshot_observed_at":"2026-07-06T22:55:33.502756Z","submitted_at":"2026-04-08T15:53:57Z","title":"PhyEdit: Towards Real-World Object Manipulation via Physically-Grounded Image Editing","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-10T18:54:47.451103Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.07230"},"observation_digest":"sha256:8b5b16205121d1d0bde357046e42ffdb635a2ad14e889a42ebaeca0588cd21bd","observation_id":"40ab478c-1c2c-44d6-9965-9e1f8be52418","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.07517","last_updated":"2026-04-08T18:52:16Z","snapshot_observed_at":"2026-07-06T22:55:46.307881Z","submitted_at":"2026-04-08T18:52:16Z","title":"Grasp as You Dream: Imitating Functional Grasping from Generated Human Demonstrations","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T17:21:30.169431Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.07517"},"observation_digest":"sha256:8ae3196c325d7f906dcf945a1804cdd42af22fb01318e6d7efafbe08059f4d9b","observation_id":"760840d0-5957-4e2f-a8a6-d9e7dfce5450","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.08610","last_updated":"2026-04-08T22:51:25Z","snapshot_observed_at":"2026-08-02T14:07:03.845616Z","submitted_at":"2026-04-08T22:51:25Z","title":"A Semi-Automated Framework for 3D Reconstruction of Medieval Manuscript Miniatures","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T17:31:45.864422Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.08610"},"observation_digest":"sha256:93d95e6cba295b443614726022e2d3cf87801395a166ef8a83ca8739112fa171","observation_id":"557e5bc0-0426-4f05-b437-91a16fdb043c","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.08626","last_updated":"2026-04-17T22:49:55Z","snapshot_observed_at":"2026-07-06T22:57:40.773778Z","submitted_at":"2026-04-09T16:00:10Z","title":"WildDet3D: Scaling Promptable 3D Detection in the Wild","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-10T17:38:13.336003Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.08626"},"observation_digest":"sha256:287ee7483abd4f883ea8c90828c929f39287dd1f53b56d5f46a06c1bb1fec734","observation_id":"daeed0ad-9d3a-48b7-96be-50771fa4fd8f","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.09100","last_updated":"2026-06-30T07:03:27Z","snapshot_observed_at":"2026-07-12T23:29:41.308155Z","submitted_at":"2026-04-10T08:32:51Z","title":"Physically Grounded 3D Generative Reconstruction under Hand Occlusion using Proprioception and Multi-Contact Touch","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T18:22:59.331357Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.09100"},"observation_digest":"sha256:1bd51a119eafa87bea0162ab1ee61f9a53e029733fff602b417f630f2e24da8d","observation_id":"ee9284d3-599f-442b-9fdb-6da8d2222514","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.10125","last_updated":"2026-04-11T09:41:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-11T09:41:42Z","title":"PhyMix: Towards Physically Consistent Single-Image 3D Indoor Scene Generation with Implicit--Explicit Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T15:49:55.281436Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.10125"},"observation_digest":"sha256:84b2ea543eb6c0a1ec41f5561a03a693eaf44211de237f391c7bfb132eb37c88","observation_id":"da9a93c5-2082-4828-a61c-681d7bcd473f","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-07-12T22:20:17.569353Z","title":"arXiv preprint arXiv:2511.16624 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.10788","last_updated":"2026-05-30T11:15:20Z","snapshot_observed_at":"2026-08-02T23:24:19.874403Z","submitted_at":"2026-04-12T19:38:19Z","title":"TInR: Exploring Tool-Internalized Reasoning in Large Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T22:20:17.569353Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.10788"},"observation_digest":"sha256:b91ca4c53c334b28b60a5848a908f6c699ab76634b1d78c9408680c2ba35da7c","observation_id":"f292da8a-ec3b-489d-b2b2-77bf50676ba8","resolution":{"observed_at":"2026-07-12T22:20:17.569353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.10789","last_updated":"2026-04-12T19:42:12Z","snapshot_observed_at":"2026-07-06T22:59:18.756089Z","submitted_at":"2026-04-12T19:42:12Z","title":"ReplicateAnyScene: Zero-Shot Video-to-3D Composition via Textual-Visual-Spatial Alignment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T15:38:03.377613Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.10789"},"observation_digest":"sha256:d9e5c7c6686228f0844c4a074d6b7a2df9101e7759d89455b8b13698496d951d","observation_id":"e16cf880-b788-4608-9990-076073f22920","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.10809","last_updated":"2026-04-12T20:40:59Z","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T20:40:59Z","title":"WARPED: Wrist-Aligned Rendering for Robot Policy Learning from Egocentric Human Demonstrations","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-10T15:14:24.932972Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.10809"},"observation_digest":"sha256:855bc8fd25acdcc379cd8df2b2d8920897e420adc71a41ccecdfa285cf9646d3","observation_id":"c8e23d4d-240b-4098-9c17-5e8062be8d87","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.11789","last_updated":"2026-04-20T14:38:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-13T17:55:02Z","title":"LMMs Meet Object-Centric Vision: Understanding, Segmentation, Editing and Generation","version":2},"reference_index":158,"source":"pdf_text","source_observed_at":"2026-05-10T15:35:37.095627Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.11789"},"observation_digest":"sha256:30670d0c854657585e3ece9b873fdb558fcd0d1ef32075cfba187db0ef1f245d","observation_id":"3ed7ef23-b7e0-4915-87f7-ac7369af8975","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.12929","last_updated":"2026-04-14T16:19:12Z","snapshot_observed_at":"2026-07-06T23:01:00.830207Z","submitted_at":"2026-04-14T16:19:12Z","title":"Grasp in Gaussians: Fast Monocular Reconstruction of Dynamic Hand-Object Interactions","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T15:01:52.354836Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.12929"},"observation_digest":"sha256:ff5ed80a31a10314862a183f288255488c502fbf54dfff186d27e0cfb25dbdb8","observation_id":"755877b7-c0f4-4e53-bcaa-468a2158aff2","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.15569","last_updated":"2026-04-16T22:55:39Z","snapshot_observed_at":"2026-07-06T23:03:07.228701Z","submitted_at":"2026-04-16T22:55:39Z","title":"ShapeGen: Robotic Data Generation for Category-Level Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T10:17:05.939312Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.15569"},"observation_digest":"sha256:1836c3da72c285d69a2ab82c142c6bbad9367d9c10f34cf52e7ecdcca4abba63","observation_id":"fd7e5b9f-9f31-4159-a41b-5e35a44636ce","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.16170","last_updated":"2026-04-17T15:38:33Z","snapshot_observed_at":"2026-07-06T23:03:34.795570Z","submitted_at":"2026-04-17T15:38:33Z","title":"neuralCAD-Edit: An Expert Benchmark for Multimodal-Instructed 3D CAD Model Editing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T09:10:57.869089Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.16170"},"observation_digest":"sha256:7918330a80a00d643408aa6045c3b47797e99c9570cb15eb71e8fa2aa0d4a911","observation_id":"70cf0655-ba23-4989-95ea-7bd3756f78db","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.17258","last_updated":"2026-04-19T04:42:14Z","snapshot_observed_at":"2026-08-04T23:29:45.402978Z","submitted_at":"2026-04-19T04:42:14Z","title":"A Rapid Deployment Pipeline for Autonomous Humanoid Grasping Based on Foundation Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T06:15:27.908393Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.17258"},"observation_digest":"sha256:72dbe0eb7db9ee9874036b09a5adb5ee602564c691170d83b908af3e827e8fb3","observation_id":"e315fd0b-9891-4181-8dff-c09a9d06139e","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.17623","last_updated":"2026-05-20T22:21:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-19T21:21:11Z","title":"ViPS: Video-informed Pose Spaces for Auto-Rigged Meshes","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T05:39:49.102468Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.17623"},"observation_digest":"sha256:b690b8932d1b195741f7d0409d1f6f37f38630ba9d0e2802ec926ac0303df7ec","observation_id":"07f8d148-eee6-4497-8471-a1e292ec38e2","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.17623","last_updated":"2026-05-20T22:21:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-19T21:21:11Z","title":"ViPS: Video-informed Pose Spaces for Auto-Rigged Meshes","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T11:31:26.240607Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.17623"},"observation_digest":"sha256:ba0cf10b56d8b933b516523d2d3309e96e43e4945ef5f8d8e53aed28d23846b5","observation_id":"3ba06b50-c3bb-4754-8178-7c7e73f8cb0d","resolution":{"observed_at":"2026-05-22T11:31:29.177761Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.18468","last_updated":"2026-04-20T16:20:57Z","snapshot_observed_at":"2026-07-06T23:05:21.974248Z","submitted_at":"2026-04-20T16:20:57Z","title":"Asset Harvester: Extracting 3D Assets from Autonomous Driving Logs for Simulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T04:18:35.668119Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.18468"},"observation_digest":"sha256:cd6f315ef6511079f3c3b1ee82fba4c10077d1a670b9f4d5e463e98263f78351","observation_id":"450d0b41-a7c6-4ee4-b472-81cd8d08758f","resolution":{"observed_at":"2026-05-11T12:01:06.265665Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.19092","last_updated":"2026-05-14T07:32:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-21T05:09:56Z","title":"RoboWM-Bench: A Benchmark for Evaluating World Models in Robotic Manipulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T03:02:26.084185Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.19092"},"observation_digest":"sha256:9c4f1d9a8bf6bc3a82b55a6e69d6761b7870732f982bd81aebec744aa6e911cf","observation_id":"56634020-7172-4caf-9526-19eee3e746f4","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.19092","last_updated":"2026-05-14T07:32:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-21T05:09:56Z","title":"RoboWM-Bench: A Benchmark for Evaluating World Models in Robotic Manipulation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T06:15:32.881140Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.19092"},"observation_digest":"sha256:e511ab3405c43e9cabc3609349ab045317fd068481a3519745d684badfc78eb2","observation_id":"6b8d493a-3c7d-4e1b-ac1f-cabf428af90b","resolution":{"observed_at":"2026-05-15T06:19:50.298475Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.19982","last_updated":"2026-07-15T19:34:26Z","snapshot_observed_at":"2026-08-02T15:54:08.393866Z","submitted_at":"2026-04-21T20:45:58Z","title":"3DPipe: A Pipelined GPU Framework for Scalable Generalized Spatial Join over Polyhedral Objects","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T00:41:12.271847Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.19982"},"observation_digest":"sha256:039a28ca966ce381113e98fbdd3208083d06a0d1e457bcfbf66ae160ffa00f63","observation_id":"499340fb-6d28-4041-a223-4c275005742e","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-02T15:54:10.993270Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.19982","last_updated":"2026-07-15T19:34:26Z","snapshot_observed_at":"2026-08-02T15:54:08.393866Z","submitted_at":"2026-04-21T20:45:58Z","title":"3DPipe: A Pipelined GPU Framework for Scalable Generalized Spatial Join over Polyhedral Objects","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T15:54:10.993270Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.19982"},"observation_digest":"sha256:2fb84c521cbd86d429a96773443be015aa274e3ae29457e2cf45e74845b57c8e","observation_id":"04667b7f-c36f-4065-97ac-c009f855829e","resolution":{"observed_at":"2026-08-02T15:54:10.993270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.20093","last_updated":"2026-04-22T01:27:13Z","snapshot_observed_at":"2026-07-06T23:06:35.507008Z","submitted_at":"2026-04-22T01:27:13Z","title":"FurnSet: Exploiting Repeats for 3D Scene Reconstruction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T01:31:22.576593Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.20093"},"observation_digest":"sha256:eef1411f7cf4ef961bf162dd06c665400162c5573b94ea374c8bd545ff621a60","observation_id":"c5779250-2144-467d-b9dd-7e3bd6cea633","resolution":{"observed_at":"2026-05-11T13:31:05.605972Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.20800","last_updated":"2026-04-22T17:27:13Z","snapshot_observed_at":"2026-07-06T23:07:31.559812Z","submitted_at":"2026-04-22T17:27:13Z","title":"LEXIS: LatEnt ProXimal Interaction Signatures for 3D HOI from an Image","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-10T00:45:17.578520Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.20800"},"observation_digest":"sha256:d172a71eb77da36056f2734cc928d66e495ed88feefd7326b77efe4ea6b9fced","observation_id":"f70eef25-1134-4bbb-9382-1e5a2e111052","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.20841","last_updated":"2026-04-22T17:59:55Z","snapshot_observed_at":"2026-07-06T23:07:31.559812Z","submitted_at":"2026-04-22T17:59:55Z","title":"DeVI: Physics-based Dexterous Human-Object Interaction via Synthetic Video Imitation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T00:25:45.277753Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.20841"},"observation_digest":"sha256:397cbb339c53130a218fbb5d4be61920636a6ca30aff7217ecebe6cc20b2f0e2","observation_id":"a70e405e-d8e4-47f8-8778-f0957714ce41","resolution":{"observed_at":"2026-05-11T11:47:19.355163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.25459","last_updated":"2026-08-04T10:54:55Z","snapshot_observed_at":"2026-08-06T06:20:44.858236Z","submitted_at":"2026-04-28T10:05:39Z","title":"GS-Playground: A High-Throughput Photorealistic Simulator for Vision-Informed Robot Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-07T16:12:45.211236Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.25459"},"observation_digest":"sha256:b5770ba5a912da91042bd6be92cc739747e1e6c0ab289282bed2b6ff009e8e71","observation_id":"963b688a-0566-4f97-a883-59a8c87df3b9","resolution":{"observed_at":"2026-05-11T23:51:17.255802Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.27106","last_updated":"2026-04-29T18:51:21Z","snapshot_observed_at":"2026-07-06T23:12:38.453388Z","submitted_at":"2026-04-29T18:51:21Z","title":"Reconstruction by Generation: 3D Multi-Object Scene Reconstruction from Sparse Observations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-07T08:29:38.852167Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.27106"},"observation_digest":"sha256:04615034c6cc19babaa2fd90a5b2ea93bdf2b99385b7223015ea936d791bdf46","observation_id":"ad68fb61-ad22-497f-8ccb-fc8a925c8e64","resolution":{"observed_at":"2026-05-12T10:01:27.930126Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2604.28197","last_updated":"2026-04-30T17:59:58Z","snapshot_observed_at":"2026-07-06T23:13:29.310140Z","submitted_at":"2026-04-30T17:59:58Z","title":"OmniRobotHome: A Multi-Camera Platform for Real-Time Multiadic Human-Robot Interaction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T05:25:34.174220Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2604.28197"},"observation_digest":"sha256:584957b060636232981ecc576eba59166ea336921dfb17d7fc6518e359461d04","observation_id":"4eae0c44-5976-4f25-9539-6abc34cd79c3","resolution":{"observed_at":"2026-05-12T10:36:30.412142Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.00307","last_updated":"2026-05-01T00:34:19Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T00:34:19Z","title":"A Model-based Visual Contact Localization and Force Sensing System for Compliant Robotic Grippers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-09T19:51:28.677549Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.00307"},"observation_digest":"sha256:609ca70445a8240d76a66070dfbfec67b9f7360eb045d9774bc0f84f74bc963e","observation_id":"ef303b49-0f5a-47a9-9d1b-69d16582550d","resolution":{"observed_at":"2026-05-11T15:31:06.504484Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.00345","last_updated":"2026-05-01T02:05:28Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T02:05:28Z","title":"Pose-Aware Diffusion for 3D Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-09T20:14:41.740288Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.00345"},"observation_digest":"sha256:93089a4ebd69d2314716404c62aa9cfab6f73604fb70890128c43c04467a4d36","observation_id":"e62886c2-cb1f-4f9b-a184-037fc7a574ef","resolution":{"observed_at":"2026-05-11T15:21:07.201504Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.05411","last_updated":"2026-05-06T20:10:28Z","snapshot_observed_at":"2026-08-06T05:07:40.226168Z","submitted_at":"2026-05-06T20:10:28Z","title":"Creative Robot Tool Use by Counterfactual Reasoning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-08T16:13:04.706475Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.05411"},"observation_digest":"sha256:9f7f0fd3572fda1dde69d71534a3bd7053516021de191a204870ebc9c9b77992","observation_id":"6442eace-baf8-42a9-90e2-8bf8117e8ac6","resolution":{"observed_at":"2026-05-11T18:21:09.151101Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.08925","last_updated":"2026-05-16T09:07:00Z","snapshot_observed_at":"2026-08-04T03:43:41.421565Z","submitted_at":"2026-05-09T12:51:25Z","title":"ClickSeg3D: Few-Click Interactive Segmentation via Semantic Embeddings","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-12T01:50:06.044957Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.08925"},"observation_digest":"sha256:fad41d551fd01823f8070bbbbd2f7693fd66b420b1e651585a898476c67bbb9f","observation_id":"2b6134b8-ac39-49fd-8147-16510b8ba01b","resolution":{"observed_at":"2026-05-12T01:51:14.856622Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.08925","last_updated":"2026-05-16T09:07:00Z","snapshot_observed_at":"2026-08-04T03:43:41.421565Z","submitted_at":"2026-05-09T12:51:25Z","title":"ClickSeg3D: Few-Click Interactive Segmentation via Semantic Embeddings","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-20T22:59:04.578699Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.08925"},"observation_digest":"sha256:900e0b5ae374a7eed7cf2297a9dbd0c14d80fc4f9d33ca4fc9796caada116800","observation_id":"ff12118c-50a1-4be4-a68d-02a9d3ffa121","resolution":{"observed_at":"2026-05-20T22:59:11.492173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.09620","last_updated":"2026-05-19T18:14:43Z","snapshot_observed_at":"2026-07-06T23:21:39.966502Z","submitted_at":"2026-05-10T16:06:05Z","title":"MiXR: Harvesting and Recomposing Geometry from Real-World Objects for In-Situ 3D Design","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T03:41:07.096152Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.09620"},"observation_digest":"sha256:5bbf9b445eabd00777e3efc255595e5932626ed74b1c11570336af0b18a6b0de","observation_id":"2afb450a-8205-4739-bfe2-738a95e18bc5","resolution":{"observed_at":"2026-05-12T07:11:23.196427Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.09620","last_updated":"2026-05-19T18:14:43Z","snapshot_observed_at":"2026-07-06T23:21:39.966502Z","submitted_at":"2026-05-10T16:06:05Z","title":"MiXR: Harvesting and Recomposing Geometry from Real-World Objects for In-Situ 3D Design","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T08:37:52.925907Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.09620"},"observation_digest":"sha256:1f370aa3d99e5b6b9a3d2937b7b0cbdcd827122a297fea588673353123c0fb1c","observation_id":"28028e0d-788b-4a28-834a-1b1fdb98e243","resolution":{"observed_at":"2026-05-21T08:39:53.441784Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.10922","last_updated":"2026-05-11T17:55:04Z","snapshot_observed_at":"2026-07-06T23:22:47.781940Z","submitted_at":"2026-05-11T17:55:04Z","title":"Pixal3D: Pixel-Aligned 3D Generation from Images","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-12T03:54:09.129351Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.10922"},"observation_digest":"sha256:4f1de4f586c4e077925f4ea97c0c4075ae6813c0a20fd1215cc3b666e9bfa7a2","observation_id":"545dcc4d-b73f-4182-96c9-051160de1126","resolution":{"observed_at":"2026-05-12T03:56:20.397928Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.11756","last_updated":"2026-05-12T08:30:53Z","snapshot_observed_at":"2026-07-06T23:23:34.924221Z","submitted_at":"2026-05-12T08:30:53Z","title":"Focusable Monocular Depth Estimation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:24.577903Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.11756"},"observation_digest":"sha256:58b3985b8b5eb77b4af62899579ecbc64f8b30971409d8d5ac5f55f33f99fa97","observation_id":"24b12327-a28c-4e05-97e2-287787d3bf60","resolution":{"observed_at":"2026-05-13T05:52:22.938506Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.15843","last_updated":"2026-05-15T10:56:23Z","snapshot_observed_at":"2026-07-06T23:27:05.961780Z","submitted_at":"2026-05-15T10:56:23Z","title":"WorldAct: Activating Monolithic 3D Worlds into Interactive-Ready Object-Centric Scenes","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T19:58:06.536869Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.15843"},"observation_digest":"sha256:8cf3b9c74357cdd2bf9e7552cda8c4951b0fa1427b3c5d70ea230ef6e808b102","observation_id":"4eafda3a-ea38-43a6-b10a-10d7f31bf4ad","resolution":{"observed_at":"2026-05-20T19:58:58.780388Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.19587","last_updated":"2026-05-19T09:31:04Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:31:04Z","title":"SceneCode: Executable World Programs for Editable Indoor Scenes with Articulated Objects","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T06:02:49.590343Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.19587"},"observation_digest":"sha256:404f5f13cd354c5625fb988cba8c55b209cee50f05db5e4bf49f279f0746a88f","observation_id":"f37aad7a-a964-42b4-9617-93b9859e086b","resolution":{"observed_at":"2026-05-20T06:03:05.122240Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.20373","last_updated":"2026-05-19T18:24:05Z","snapshot_observed_at":"2026-08-05T07:51:11.697546Z","submitted_at":"2026-05-19T18:24:05Z","title":"SUGAR: A Scalable Human-Video-Driven Generalizable Humanoid Loco-Manipulation Learning Framework","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-21T07:17:20.468640Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.20373"},"observation_digest":"sha256:3d816035a38f8c3fb09989604719f9f93651cb67d6a54fbffd2ddae952509969","observation_id":"94a13c00-8d8b-4b43-92eb-0b5d848e1151","resolution":{"observed_at":"2026-05-21T07:19:46.897747Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.21472","last_updated":"2026-08-04T12:52:46Z","snapshot_observed_at":"2026-08-06T06:20:47.566765Z","submitted_at":"2026-05-20T17:55:16Z","title":"Stream3D: Sequential Multi-View 3D Generation via Evidential Memory","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T04:49:58.127599Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.21472"},"observation_digest":"sha256:88d9f0b007f63e3fb207051d793ec08d93afdf46d7ed8c183a9aba5845fa3ccc","observation_id":"06d1c7db-fa87-412f-a69a-63dc819cced4","resolution":{"observed_at":"2026-05-21T04:53:58.202368Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.21472","last_updated":"2026-08-04T12:52:46Z","snapshot_observed_at":"2026-08-06T06:20:47.566765Z","submitted_at":"2026-05-20T17:55:16Z","title":"Stream3D: Sequential Multi-View 3D Generation via Evidential Memory","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T16:51:48.920965Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.21472"},"observation_digest":"sha256:ee9865ac088ea335c5b703dcc74de3ddfdbd9c7267af026a80d26b883c1f1b6b","observation_id":"be882b8a-20ae-4ee2-85ce-3bd5a92b81b5","resolution":{"observed_at":"2026-06-30T16:54:58.485140Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.21935","last_updated":"2026-05-21T03:11:43Z","snapshot_observed_at":"2026-07-06T23:32:20.708664Z","submitted_at":"2026-05-21T03:11:43Z","title":"Learning to Evolve: Multi-modal Interactive Fields for Robust Humanoid Navigation in Dynamic Environments","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T05:55:16.917358Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.21935"},"observation_digest":"sha256:4d559942f93d21c9c4cdad92f988e6537593ba511d5907a04c0969d931b32838","observation_id":"3e0629f7-ecb3-404d-af05-b8c663678e4a","resolution":{"observed_at":"2026-05-22T05:56:08.050306Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.23523","last_updated":"2026-05-22T11:39:49Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T11:39:49Z","title":"ComPose: When to Trust Hands for Object Pose Tracking","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-25T05:12:55.632000Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.23523"},"observation_digest":"sha256:af668ee598eafd8fb50bacc705428002ec5536e3e2e9677f55a35c94f1e6f0ac","observation_id":"80168ba2-7c8f-4466-a026-2c39674fcca0","resolution":{"observed_at":"2026-05-25T05:15:22.442501Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.23699","last_updated":"2026-05-22T14:51:22Z","snapshot_observed_at":"2026-07-06T23:33:53.870540Z","submitted_at":"2026-05-22T14:51:22Z","title":"CRONOS: Benchmarking Counterfactual Physical Consistency in Video Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-25T04:39:22.400458Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.23699"},"observation_digest":"sha256:a501e4433aaf32c6130b5bc95d6c16bb561097ed37d4c76494d8c3d8422f1e8e","observation_id":"95b5638e-e93a-46ff-9775-30c63dcad368","resolution":{"observed_at":"2026-05-25T04:40:23.288143Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.25326","last_updated":"2026-05-25T01:16:19Z","snapshot_observed_at":"2026-07-06T23:35:16.647496Z","submitted_at":"2026-05-25T01:16:19Z","title":"Perceive-then-Plan: Layout-as-Policy for Monocular 3D Scene Layout Estimation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-29T23:11:59.282627Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.25326"},"observation_digest":"sha256:c5e0e392e6f46bd3c4f2cc06a4063ed79bf3d53aa299f84294e9602ae210f9f1","observation_id":"2e6eb442-5082-41f3-8650-a58bc7a7d587","resolution":{"observed_at":"2026-06-29T23:14:01.267089Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.26113","last_updated":"2026-05-25T17:59:48Z","snapshot_observed_at":"2026-08-05T18:59:45.803385Z","submitted_at":"2026-05-25T17:59:48Z","title":"AnyScene: Towards Highly Controllable Driving Scene Generation at Anywhere and Beyond","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T21:15:12.465970Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.26113"},"observation_digest":"sha256:14ac3cccb60d81982c061b7ebccfd5d3a3009608d5265b4419634a8ed1cc23b8","observation_id":"12961eee-f75e-4c54-becf-003bfaf95d4e","resolution":{"observed_at":"2026-06-29T22:04:00.904527Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.26944","last_updated":"2026-05-26T12:32:50Z","snapshot_observed_at":"2026-07-06T23:36:43.912215Z","submitted_at":"2026-05-26T12:32:50Z","title":"Object Pose and Shape Estimation for Grasping: Does it Work?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T16:37:19.604421Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.26944"},"observation_digest":"sha256:d0ed2605f4763fbae088bc02b68721301c8ff6048c69280f1c721098b75a8900","observation_id":"eb53e4c1-3226-4ad0-bc93-830f22905d48","resolution":{"observed_at":"2026-06-29T16:43:40.582043Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.30093","last_updated":"2026-05-28T15:37:59Z","snapshot_observed_at":"2026-08-03T18:29:28.904477Z","submitted_at":"2026-05-28T15:37:59Z","title":"Geometry Matters: 3D Foundation Priors for Learning Semantic Correspondence","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T08:27:20.516403Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.30093"},"observation_digest":"sha256:b425ecb447b1a54e1d755d02f626213eb337b0656f68a132210bf3ee9b86acc7","observation_id":"e49d1ffc-db33-473b-8b4a-a10bfc27d853","resolution":{"observed_at":"2026-06-29T08:33:15.454977Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.30239","last_updated":"2026-08-02T12:20:19Z","snapshot_observed_at":"2026-08-06T07:12:18.721161Z","submitted_at":"2026-05-28T17:07:51Z","title":"CA-World: Multi-Object Counterfactual Alignment for Efficient Interactive-Ready Reconstruction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T07:42:13.082630Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.30239"},"observation_digest":"sha256:0d08715d423d97acabe8a29477a9e7133a0c396b6b20afbfadc31477dd263f1e","observation_id":"11f39ef1-3d7f-4652-8873-6b02465904a4","resolution":{"observed_at":"2026-06-29T07:43:13.321774Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-04T04:59:16.704068Z","title":"arXiv preprint arXiv:2511.16624 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30239","last_updated":"2026-08-02T12:20:19Z","snapshot_observed_at":"2026-08-06T07:12:18.721161Z","submitted_at":"2026-05-28T17:07:51Z","title":"CA-World: Multi-Object Counterfactual Alignment for Efficient Interactive-Ready Reconstruction","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T04:59:16.704068Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.30239"},"observation_digest":"sha256:d6a6dbb95f6c22e6f013d9463dbde8df1695f6cd4755789f8622cbb5950cad68","observation_id":"090f11ef-daa8-4c5e-8f48-48f72a486f37","resolution":{"observed_at":"2026-08-04T04:59:16.704068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2605.30338","last_updated":"2026-05-28T17:59:01Z","snapshot_observed_at":"2026-07-06T23:39:38.845840Z","submitted_at":"2026-05-28T17:59:01Z","title":"REST3D: Reconstructing Physically Stable 3D Scenes from a Single Image","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T07:44:41.469789Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2605.30338"},"observation_digest":"sha256:2a49d000eb40857b17e925cb3a531c863bd27ff97b7dc1b9422a18dd02d8c17f","observation_id":"ef3c22e5-4b29-43d2-a370-80671a9da0bb","resolution":{"observed_at":"2026-06-29T07:53:14.090865Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.00299","last_updated":"2026-05-29T19:28:07Z","snapshot_observed_at":"2026-08-02T16:30:13.912725Z","submitted_at":"2026-05-29T19:28:07Z","title":"Real2SAM2Real: Generative 3D Caches as Complementary Context for Video Diffusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T22:41:00.915004Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.00299"},"observation_digest":"sha256:cdf2674dc300420abb27e3bb7d3a7e3a47d7c5412d048e0bdcb41324dadd9fa5","observation_id":"4340dd9c-5359-492f-876c-1dbdab5defff","resolution":{"observed_at":"2026-06-28T22:42:46.282654Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.01458","last_updated":"2026-05-31T21:36:02Z","snapshot_observed_at":"2026-07-06T23:42:02.762832Z","submitted_at":"2026-05-31T21:36:02Z","title":"LEGS: Fine-Tuning Teleop-Free VLAs for Humanoid Loco-manipulation in an Embodied Gaussian Splatting World","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T16:44:58.278040Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.01458"},"observation_digest":"sha256:5d1736c1a0d99b17c7946d42e4356ba22d42e376e1b14a223bcc8e5bea92d3ae","observation_id":"b5d8898b-b60d-49d3-afa1-6b4bfcc54255","resolution":{"observed_at":"2026-07-01T21:36:15.063498Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.01545","last_updated":"2026-06-01T01:45:47Z","snapshot_observed_at":"2026-07-06T23:42:07.508474Z","submitted_at":"2026-06-01T01:45:47Z","title":"Hierarchical Object Representation for Spatial Robot Perception: Points, Meshes, and Superquadrics","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T14:52:13.945981Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.01545"},"observation_digest":"sha256:d90a47485c2dee2083b4b6ec942c5c80c958bd057d23514655583d9cb71b200d","observation_id":"8bb7c270-f02f-4cfb-8162-bb403648ea40","resolution":{"observed_at":"2026-07-01T22:56:20.322689Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.02021","last_updated":"2026-06-01T10:11:15Z","snapshot_observed_at":"2026-07-06T23:42:30.555538Z","submitted_at":"2026-06-01T10:11:15Z","title":"PerBite: A Curated Diagnostic Workflow for Bite-Aware Food Volume Estimation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T14:56:15.183480Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.02021"},"observation_digest":"sha256:74c718216402a56be707ac048cbc4c1518dc6e6f359254db452dfcc059a2e0bb","observation_id":"47924ca6-d2ba-4bf6-9c19-dac6b3c91365","resolution":{"observed_at":"2026-07-01T22:56:19.836779Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.02491","last_updated":"2026-06-01T17:01:21Z","snapshot_observed_at":"2026-08-03T04:26:51.126265Z","submitted_at":"2026-06-01T17:01:21Z","title":"MORPHOS: Autoregressive 4D Generation with Temporal Structured Latents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T15:03:22.366584Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.02491"},"observation_digest":"sha256:118f268152c0d99be4d9c213e667b2a2e8489040a3020c614548865a12eff012","observation_id":"0bcd7ad2-fd7c-4c47-8c8c-42ccdc8be0fc","resolution":{"observed_at":"2026-07-01T22:46:19.568414Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.02580","last_updated":"2026-06-01T17:59:53Z","snapshot_observed_at":"2026-08-05T18:42:12.160719Z","submitted_at":"2026-06-01T17:59:53Z","title":"Thinking in Blender: Staged Executable Inverse Graphics with Vision-Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-28T15:04:01.773923Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.02580"},"observation_digest":"sha256:ed7222202df3a04c511d0dd8afde4b7de055d05ccd94383ff54e6ae074b3df0a","observation_id":"7250f969-66ae-4a8b-8f6b-ab227accdae9","resolution":{"observed_at":"2026-07-01T22:46:19.324961Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.03921","last_updated":"2026-07-07T02:27:27Z","snapshot_observed_at":"2026-07-30T18:08:22.956996Z","submitted_at":"2026-06-02T17:13:01Z","title":"GARDEN: Gravity-Aligned Reconstruction of Disentangled ENvironments from RGB images","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T10:40:13.795382Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.03921"},"observation_digest":"sha256:abffa292c0c92631709da2142342b2a418e97fa36a546a90ab629705511db9c4","observation_id":"f1d385d3-9275-4c20-a5e4-983fbf5d4a31","resolution":{"observed_at":"2026-07-02T02:46:28.509278Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.03994","last_updated":"2026-06-02T17:59:59Z","snapshot_observed_at":"2026-07-06T23:44:09.692359Z","submitted_at":"2026-06-02T17:59:59Z","title":"SimuScene: Simulation-Ready Compositional 3D Scene Reconstruction from a Single Image","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T10:59:17.553098Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.03994"},"observation_digest":"sha256:93f2cf35a36e92a197ff812606723c1dd5e0e6c148122f9d941dca60f77aa8c5","observation_id":"051697f4-18a3-4f7d-a487-b3d988e315e5","resolution":{"observed_at":"2026-07-02T02:26:26.369389Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.04108","last_updated":"2026-06-02T18:11:41Z","snapshot_observed_at":"2026-08-03T20:33:55.734535Z","submitted_at":"2026-06-02T18:11:41Z","title":"SymTRELLIS: Symmetry-Enforced Voxel Latents for 3D Generation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-28T07:18:26.981583Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.04108"},"observation_digest":"sha256:082ed40fe51be55fb0bdf4392cd4d794c52073f11274930fc6a7bcaf55b4a6c5","observation_id":"68de7a7b-d088-4338-91da-71d28fc4c718","resolution":{"observed_at":"2026-07-02T06:56:44.525728Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-02T06:54:38.362311Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:fc86e8e1bc51459de046d01fc2db9e79e5a1f130001085dd2d542ef42790b41f","observation_id":"e2c5d413-ee78-4808-9bf4-48dba6c102ec","resolution":{"observed_at":"2026-07-02T03:16:33.499145Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.06155","last_updated":"2026-06-04T13:28:51Z","snapshot_observed_at":"2026-07-29T15:22:02.359291Z","submitted_at":"2026-06-04T13:28:51Z","title":"AffordanceVLA: A Vision-Language-Action Model Empowering Action Generation through Affordance-Aware Understanding","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-28T01:23:02.576098Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.06155"},"observation_digest":"sha256:efd205933d145d611e057af720c7c0dc32ba54842277125642061ae521112919","observation_id":"909f8926-bbb6-48dd-8ffc-51ba8d7ee69b","resolution":{"observed_at":"2026-07-02T13:16:59.188833Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.06390","last_updated":"2026-06-04T16:58:43Z","snapshot_observed_at":"2026-08-02T17:30:35.873984Z","submitted_at":"2026-06-04T16:58:43Z","title":"HomeWorld: A Unified Floorplan-to-Furnished Framework for Generating Controllable, Densely Interactive Whole-Home Scenes","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T01:45:03.954475Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.06390"},"observation_digest":"sha256:85c5f089c54d727ab55f24169f859db7544dd71559ffc02e68046dd28d7ffa6a","observation_id":"a69e18b2-d97b-4999-b870-bcefe606c7cf","resolution":{"observed_at":"2026-07-02T12:56:56.996281Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.08057","last_updated":"2026-06-06T08:39:52Z","snapshot_observed_at":"2026-08-01T18:35:24.229661Z","submitted_at":"2026-06-06T08:39:52Z","title":"EgoAERO: Learning Dexterous Manipulation from a Single Egocentric Video without Object Assets","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T19:50:51.089063Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.08057"},"observation_digest":"sha256:5f3c149f85d96658cb01ed53e1f03c2d4e8ebe4a7ae31403ff7ae13b1cede84d","observation_id":"fa829e8f-bbde-4fbf-8470-5d26421c88f0","resolution":{"observed_at":"2026-07-02T21:17:24.732138Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.08440","last_updated":"2026-06-07T03:37:55Z","snapshot_observed_at":"2026-08-02T10:50:14.191601Z","submitted_at":"2026-06-07T03:37:55Z","title":"GraspFoM: Towards Reconstruction-Driven Robotic Grasping with 3D Foundation Priors","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T18:47:30.907614Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.08440"},"observation_digest":"sha256:657eae4fc0b98b0a18113c1353a1154a937c9028ebd9f654a45e976e2d2f6c07","observation_id":"3c5efa30-13a0-4d63-b3f1-8765d5571ea7","resolution":{"observed_at":"2026-07-02T22:37:25.873921Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.08828","last_updated":"2026-06-07T20:45:47Z","snapshot_observed_at":"2026-07-06T23:48:16.585598Z","submitted_at":"2026-06-07T20:45:47Z","title":"Video2Sim2Real: Full-Stack Autonomous Dexterous Skill Acquisition from a Single Human Video","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-27T18:05:27.871988Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.08828"},"observation_digest":"sha256:5a218f1bdde416c57f12562769628a1210d7bea45f0dee2e3292921e0dfd4060","observation_id":"31ffd106-aef8-4bd5-899b-c21edf7e2303","resolution":{"observed_at":"2026-07-02T23:37:27.699843Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.12604","last_updated":"2026-06-10T19:01:40Z","snapshot_observed_at":"2026-08-05T03:29:41.720044Z","submitted_at":"2026-06-10T19:01:40Z","title":"EgoEngine: From Egocentric Human Videos to High-Fidelity Dexterous Robot Demonstrations","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-27T09:27:43.453005Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.12604"},"observation_digest":"sha256:428311b11e43f942da829d45fa5d0755643351e94d057e0dbaed8b73b8a77205","observation_id":"9993cd1e-160f-471d-b58c-fafccddd3856","resolution":{"observed_at":"2026-07-03T11:38:05.050707Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.13644","last_updated":"2026-06-11T17:48:38Z","snapshot_observed_at":"2026-08-05T18:33:40.379196Z","submitted_at":"2026-06-11T17:48:38Z","title":"Surflo: Consistent 3D Surface Flow Model with Global State","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T06:58:59.111924Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.13644"},"observation_digest":"sha256:3f59cdf8b19103de596305331a648f58bb6f786bbb855e4875d87ba8f42f0b05","observation_id":"c084062d-73dd-4f3e-8b7f-c47fbd88cda9","resolution":{"observed_at":"2026-07-03T14:38:29.174549Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.13652","last_updated":"2026-06-11T17:52:48Z","snapshot_observed_at":"2026-08-02T13:31:38.311637Z","submitted_at":"2026-06-11T17:52:48Z","title":"World Tracing: Generative Pixel-Aligned Geometry Beyond the Visible","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-27T06:56:46.694079Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.13652"},"observation_digest":"sha256:d487c464fb1c65e4f3eea45ff5fc156c198a2a3e1098d133291ca3bf572fbef6","observation_id":"00535ec4-1329-4ca3-a9d9-913999174d08","resolution":{"observed_at":"2026-07-03T14:38:29.368323Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.13676","last_updated":"2026-06-11T17:59:45Z","snapshot_observed_at":"2026-07-30T07:52:34.479621Z","submitted_at":"2026-06-11T17:59:45Z","title":"Modality Forcing for Scalable Spatial Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T06:45:00.481276Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.13676"},"observation_digest":"sha256:17a4aafacf6c5e2dddc6c76e925af43eb1667b2a1164355ec39e76d45ad2d828","observation_id":"129aac89-cac6-459f-b181-5619f99fb8f1","resolution":{"observed_at":"2026-07-03T15:08:32.568730Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-02T11:25:09.608614Z","title":"Sam 3d: 3dfy anything in images,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.15287","last_updated":"2026-06-13T12:53:52Z","snapshot_observed_at":"2026-08-02T11:25:06.059314Z","submitted_at":"2026-06-13T12:53:52Z","title":"G2IA: Geometry-Guided Instance-Aware Retrieval and Refinement for Cross-Modal Place Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T11:25:09.608614Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.15287"},"observation_digest":"sha256:8ecaffd8713cebae5f9c4cc15c2a8b3849e1f88d71164eb4105cea14890ea28e","observation_id":"d90dc34f-8301-42ea-9090-254c8a2e854e","resolution":{"observed_at":"2026-08-02T11:25:09.608614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.15908","last_updated":"2026-06-18T10:15:42Z","snapshot_observed_at":"2026-08-03T12:18:30.351069Z","submitted_at":"2026-06-14T16:36:49Z","title":"High-Fidelity 4D Hand-Object Capture via Multi-View Spatiotemporal Tracking and Physics-Aware Gaussians","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-27T03:33:27.321671Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.15908"},"observation_digest":"sha256:d129f172800759936542ea8ee527f782a73039c631529860230b93334937ca43","observation_id":"bbe0160c-573f-4e0d-b010-8bd5d3c57400","resolution":{"observed_at":"2026-07-03T17:58:47.309343Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.17054","last_updated":"2026-06-15T17:59:36Z","snapshot_observed_at":"2026-07-06T23:52:42.390632Z","submitted_at":"2026-06-15T17:59:36Z","title":"Human Universal Grasping","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-27T03:54:04.149409Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.17054"},"observation_digest":"sha256:534e4cb46db242ee74dd1d7d8e9f3a760ce99f35c2824f1bdf1330e3b16c2bd7","observation_id":"febd649a-9a10-475f-af85-4ae2703f3ba2","resolution":{"observed_at":"2026-07-03T17:38:44.363514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.17385","last_updated":"2026-06-19T08:44:25Z","snapshot_observed_at":"2026-08-01T15:20:43.162291Z","submitted_at":"2026-06-16T00:44:16Z","title":"EgoInfinity: A Web-Scale 4D Hand-Object Interaction Data Engine for Any-View Robot Retargeting and Video-to-Action Robot Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T01:35:25.740110Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.17385"},"observation_digest":"sha256:356147bc5cadf0db6e46bee08168df606b1eb13916bbb71228d9eb49b7bb34fb","observation_id":"59a57dbd-c9b0-4d36-8714-252480cde579","resolution":{"observed_at":"2026-07-03T20:08:56.445048Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.17520","last_updated":"2026-06-16T05:00:42Z","snapshot_observed_at":"2026-07-06T23:53:07.149182Z","submitted_at":"2026-06-16T05:00:42Z","title":"GASE: Gaussian Splatting-Based Automated System for Reconstructing Embodied-Simulation Environments","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-27T00:57:02.382938Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.17520"},"observation_digest":"sha256:80ae195e1c3d9d3c5a25b392afe775f14288d23fcc953a265a588f06080d2ad1","observation_id":"3a152134-4cce-4f5e-9c9e-7d1aca32e4b7","resolution":{"observed_at":"2026-07-03T21:08:57.921994Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.17783","last_updated":"2026-06-16T10:59:12Z","snapshot_observed_at":"2026-08-03T15:42:58.548344Z","submitted_at":"2026-06-16T10:59:12Z","title":"Is It Real? Exploiting Virtual-Physical Discrimination Vulnerability in Mixed Reality","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-26T23:14:01.245186Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.17783"},"observation_digest":"sha256:51c1ba709b3c661290253131c4905a3d04447153355eec44ce5f5df7f12fa41b","observation_id":"6661700c-fb72-4948-8c39-147beb821376","resolution":{"observed_at":"2026-07-03T22:49:02.841062Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2511.16624/citation-record","integrity":"/paper/2511.16624/integrity","json":"/paper/2511.16624/citation-record.json","paper":"/paper/2511.16624"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":"2404.14219","doi":"10.48550/arxiv.2404.14219","metadata_source":"pith","pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","venue":"cs.CL","work_id":"feef9556-a016-493c-abd2-0c97a23a7ebf","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:5d47886a30c3b2d32b8a85a90a5dd9e9fda3abd504da8b8d434dea0a7a8f7e28","observation_id":"21ed7b18-de40-4d1e-9578-a1254fffa4c1","resolution":{"observed_at":"2026-05-11T11:47:17.285059Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3374.155338","doi":"10.1145/1553374.1553380","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Curriculum learning, in: Proceedings of the 26th Annual International Conference on Machine Learning, Associa- tion for Computing Machinery, New York, NY, USA","venue":null,"work_id":"5d30e737-af53-4f1d-8f90-c8e0159a22ba","year":2009},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:2332fba5d25c9bdd0999b999ced7bf072a49d4aaa093990f64d7aa150eb9de6d","observation_id":"3d44d26a-32af-41a3-80d2-a1c5f071ff2a","resolution":{"observed_at":"2026-05-11T11:47:11.837832Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T01:20:08.326125+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T01:20:08.326125+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:57:14.742120Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901","venue":null,"work_id":"84780adb-76cf-44ac-a8b7-e24d4fa5c592","year":1901},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:49ba31c941abf526f09dd8a5fc40b0d892146cfa110af0f0f14013e9948b2956","observation_id":"b84a3c4b-dd4c-49f6-a8a3-fd6db979ef93","resolution":{"observed_at":"2026-05-11T11:47:17.576351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03012","last_updated":"2015-12-09T19:42:48Z","snapshot_observed_at":"2026-08-02T21:55:14.093687Z","submitted_at":"2015-12-09T19:42:48Z","title":"ShapeNet: An Information-Rich 3D Model Repository","version":1},"cited_work":{"arxiv_id":"1512.03012","doi":"10.1111/2041-210x.12301","metadata_source":"pith","pith_arxiv_id":"1512.03012","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ShapeNet: An Information-Rich 3D Model Repository","venue":"cs.GR","work_id":"b2ac5b60-daa9-435b-9369-12271e126edd","year":2015},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/1512.03012","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:efacc78341a737bc9a3dd0d80f0cda64d757eab417fd8eca59f9033bc104cd0b","observation_id":"bf7773f8-3fc8-4367-a8ee-a1efd399c552","resolution":{"observed_at":"2026-05-11T16:09:06.508173Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10479-005-5724-z","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Mannor, Shie and Rubinstein, Reuven Y","venue":"Annals of Operations Research","work_id":"bd0dd010-91c9-4a0e-89f3-be9d379f9cb4","year":2005},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:534f7c7ce60d3b8cfabca29008f2fa58604a168f11a0eb78b2f30157742736b9","observation_id":"a2fb5780-9dfe-47da-9682-156d14ccad53","resolution":{"observed_at":"2026-05-11T11:47:12.055043Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-20T05:23:43.529713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T05:23:43.529713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":"2505.14683","doi":"10.48550/arxiv.2505.14683","metadata_source":"pith","pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emerging Properties in Unified Multimodal Pretraining","venue":"cs.CV","work_id":"e0cfd82c-f5d4-44fd-b531-ec73ab0a805b","year":2025},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:45cd7e943d7b37e64172f09789403f0b95c0de7deaf150f7dd1c987e7a34c386","observation_id":"8c672bf8-d4ea-4c7e-8f1b-aed6c558ade9","resolution":{"observed_at":"2026-05-11T11:47:12.965136Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1509/jmkr.47.2.312.https://doi.org/10.1509/jmkr.47.2.312","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hanze Dong, Wei Xiong, Deepanshu Goyal, Yihan Zhang, Winnie Chow, Rui Pan, Shizhe Diao, Jipeng Zhang, KaShun SHUM, and Tong Zhang","venue":null,"work_id":"52829286-8784-4d6a-9617-d8e12897c963","year":null},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:19af62e003f6b9ee2abfad61e8f2681057e7116e1727357913af8e5c22646760","observation_id":"f6f78e7d-119b-4575-a889-8e2d463f494f","resolution":{"observed_at":"2026-05-11T11:47:12.258790Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18787","last_updated":"2025-06-23T15:57:10Z","snapshot_observed_at":"2026-08-04T14:19:21.372936Z","submitted_at":"2025-06-23T15:57:10Z","title":"3D Arena: An Open Platform for Generative 3D Evaluation","version":1},"cited_work":{"arxiv_id":"2506.18787","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.18787","snapshot_observed_at":"2026-07-03T01:07:30.803101Z","title":"3d arena: An open platform for generative 3d evaluation.arXiv preprint arXiv:2506.18787","venue":null,"work_id":"cbb1a6f0-d3e2-4d3b-aba8-7002e0537c04","year":2025},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2506.18787","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:0fc74bab50306d9784d595e0de04546561eed8488d8404ebca1849a73baeb847","observation_id":"24305c4d-36a5-4e73-9d1e-ead615be3eb9","resolution":{"observed_at":"2026-05-11T11:47:16.046427Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12557","last_updated":"2025-06-23T14:26:35Z","snapshot_observed_at":"2026-07-06T19:34:32.629776Z","submitted_at":"2024-10-16T13:34:40Z","title":"One Step Diffusion via Shortcut Models","version":3},"cited_work":{"arxiv_id":"2410.12557","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.12557","snapshot_observed_at":"2026-07-04T17:09:58.784233Z","title":"One Step Diffusion via Shortcut Models","venue":"cs.LG","work_id":"4017f821-b436-40dd-a38d-0b3bb52f7d99","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2410.12557","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:f072b7e3111e0b1f125fb9e649ab2b1c9d0d65728dad32e5c264a10708766b20","observation_id":"6cdb77ae-d41f-497e-a0b4-6f7805629af0","resolution":{"observed_at":"2026-05-15T06:40:55.602339Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.07978","last_updated":"2025-09-09T17:59:02Z","snapshot_observed_at":"2026-08-04T21:31:03.409786Z","submitted_at":"2025-09-09T17:59:02Z","title":"One View, Many Worlds: Single-Image to 3D Object Meets Generative Domain Randomization for One-Shot 6D Pose Estimation","version":1},"cited_work":{"arxiv_id":"2509.07978","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.07978","snapshot_observed_at":"2026-07-04T09:59:45.372573Z","title":"One View, Many Worlds: Single-Image to 3D Object Meets Generative Domain Randomization for One-Shot 6D Pose Estimation","venue":null,"work_id":"bd6da01e-9538-479d-bd39-7599ebcfe85a","year":2025},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2509.07978","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:471a29195abcc2062394346a3b17884661b53ca71c80821f482b09137f158302","observation_id":"5231a3c8-f0db-42ef-a32f-21e0e8a8e8df","resolution":{"observed_at":"2026-05-11T11:47:16.335868Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1311.2524","last_updated":"2014-10-22T17:23:20Z","snapshot_observed_at":"2026-07-06T03:27:53.279398Z","submitted_at":"2013-11-11T18:43:49Z","title":"Rich feature hierarchies for accurate object detection and semantic segmentation","version":5},"cited_work":{"arxiv_id":"1311.2524","doi":"10.48550/arxiv.1311.2524","metadata_source":"pith","pith_arxiv_id":"1311.2524","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rich feature hierarchies for accurate object detection and semantic segmentation","venue":"cs.CV","work_id":"7ab130ee-d244-46bc-98cc-b84e0225ea6b","year":2013},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/1311.2524","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:40d4630abd329d36788f3fbd28c0cf730ee2b66b9aaf992a7bce79872c27ef22","observation_id":"b6e15109-21dc-4faf-a928-5bdbc01d50b9","resolution":{"observed_at":"2026-05-11T11:47:16.663352Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:2e182633cc3a321b924f5d7a61f7a33c0e376e0b2731771120b8685ffe808b58","observation_id":"254f5070-c133-4bf4-bd54-63e92edea48a","resolution":{"observed_at":"2026-05-11T11:47:16.733915Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10889","last_updated":"2024-12-20T18:42:11Z","snapshot_observed_at":"2026-08-04T19:27:35.662349Z","submitted_at":"2024-01-19T18:59:11Z","title":"Synthesizing Moving People with 3D Control","version":2},"cited_work":{"arxiv_id":"2401.10889","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.10889","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ego-exo4d: Understanding skilled human activity from first- and third-person perspectives","venue":null,"work_id":"08af24e2-03a1-47e5-b9ba-6a3d96a29748","year":null},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2401.10889","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:99d16c03faf51e746c6143c3a449ff01fea77faeeb89d09ecbcc97c5eea746ae","observation_id":"03da37fc-b795-43ef-a665-c72d09b765a2","resolution":{"observed_at":"2026-05-11T11:47:16.785867Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08998","last_updated":"2023-08-21T10:23:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-17T14:12:48Z","title":"Reinforced Self-Training (ReST) for Language Modeling","version":2},"cited_work":{"arxiv_id":"2308.08998","doi":"10.1126/sciadv.abg6611","metadata_source":"pith","pith_arxiv_id":"2308.08998","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reinforced Self-Training (ReST) for Language Modeling","venue":"cs.CL","work_id":"db054f5c-62a3-405b-aae8-43e02c39f672","year":2023},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2308.08998","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:0e502d30883081f28c4251b4565b44d9ed84c73eae156ba7f2d9909fe0329abd","observation_id":"5e27e822-4968-4a19-9c55-ab59caf4b659","resolution":{"observed_at":"2026-05-11T11:47:16.929445Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01293","last_updated":"2021-02-02T04:07:38Z","snapshot_observed_at":"2026-08-01T22:46:19.170916Z","submitted_at":"2021-02-02T04:07:38Z","title":"Scaling Laws for Transfer","version":1},"cited_work":{"arxiv_id":"2102.01293","doi":"10.48550/arxiv.2102.01293","metadata_source":"pith","pith_arxiv_id":"2102.01293","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Laws for Transfer","venue":"cs.LG","work_id":"c58fc635-4090-4314-adf6-b45af9da58e5","year":2021},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2102.01293","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:5013553b99d5732de83bfa297211b01113ec4d5c2a0e23ea710065204c15c17f","observation_id":"f3d2c095-3a4d-4366-ade1-31874646ad43","resolution":{"observed_at":"2026-05-18T00:58:13.994022Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15442","last_updated":"2025-06-18T13:14:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-18T13:14:46Z","title":"Hunyuan3D 2.1: From Images to High-Fidelity 3D Assets with Production-Ready PBR Material","version":1},"cited_work":{"arxiv_id":"2506.15442","doi":"10.48550/arxiv.2506.15442","metadata_source":"pith","pith_arxiv_id":"2506.15442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuan3D 2.1: From Images to High-Fidelity 3D Assets with Production-Ready PBR Material","venue":"cs.CV","work_id":"ee52f4d7-462f-4491-9549-4160820ae563","year":2025},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2506.15442","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:6fe127f858a7f83080e62edc7b7ca6a721f829e2d21125e9377ad75ac2e6dda8","observation_id":"7be8af77-45de-44a3-9d8c-fc9051025e13","resolution":{"observed_at":"2026-05-17T23:10:17.882063Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Category-specific object reconstruction from a single image","venue":null,"work_id":"07c049b9-f395-46a3-abaa-63c47e8d9af9","year":1966},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:75c041ee9dd403f90f95eac70fb375d3483641658b76e8d8620f64b555e30988","observation_id":"bdc38680-ea29-41b9-b40a-73d09283975f","resolution":{"observed_at":"2026-05-11T11:47:19.025079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":"1312.6114","doi":"10.2139/ssrn.4269703","metadata_source":"pith","pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Auto-Encoding Variational Bayes","venue":"stat.ML","work_id":"97d95295-30e1-42b4-bbf6-85f0fa4edb44","year":2013},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:f5d89f919c49a358d1c247846b7bf27499f722d5bccb128740ee79cca4361fb5","observation_id":"9843a289-4c63-4a89-b524-963fec63aed6","resolution":{"observed_at":"2026-05-11T11:47:13.214660Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06870","last_updated":"2022-12-13T19:30:03Z","snapshot_observed_at":"2026-08-05T04:33:53.032760Z","submitted_at":"2022-12-13T19:30:03Z","title":"MegaPose: 6D Pose Estimation of Novel Objects via Render & Compare","version":1},"cited_work":{"arxiv_id":"2212.06870","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.06870","snapshot_observed_at":"2026-07-04T09:59:45.381734Z","title":"Megapose: 6d pose estimation of novel objects via render & compare","venue":null,"work_id":"aae2e7fc-c8d3-49a0-89aa-229fca9e29cc","year":2022},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2212.06870","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:f21168e5e55033970cbfdc8465e4a48fc771d286655a006a907a7b2725f3bcbe","observation_id":"1c497440-21a0-4ed8-ad1c-4d1d97c3f41b","resolution":{"observed_at":"2026-05-11T11:47:13.276001Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13787","last_updated":"2024-06-08T16:40:12Z","snapshot_observed_at":"2026-08-02T18:11:57.036767Z","submitted_at":"2024-03-20T17:49:54Z","title":"RewardBench: Evaluating Reward Models for Language Modeling","version":2},"cited_work":{"arxiv_id":"2403.13787","doi":"10.48550/arxiv.2403.13787","metadata_source":"pith","pith_arxiv_id":"2403.13787","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Smith, and Hanna Hajishirzi","venue":"cs.LG","work_id":"ff1fdc14-8407-4029-a1e6-ce4921d8d7ae","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2403.13787","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:939cf2a10add4f4f2db610d1a05dda5ee7c8d2cd9d5cd8e88286b72f112c65c7","observation_id":"7edbe698-b7a3-458e-9e3d-ec620a6efa60","resolution":{"observed_at":"2026-05-11T11:47:13.371686Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06500","last_updated":"2023-06-15T08:00:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-11T00:38:10Z","title":"InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2305.06500","doi":"10.48550/arxiv.2305.06500","metadata_source":"pith","pith_arxiv_id":"2305.06500","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning","venue":"cs.CV","work_id":"f3aac728-ded0-4e55-aa9e-4a1635d4313d","year":2023},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2305.06500","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:4946251b53ad642922389e75e67079b67f37668c6b1e61516cb2aba7a86e10fe","observation_id":"dd7f912c-992c-4d9d-8c7e-18b6984f7f13","resolution":{"observed_at":"2026-05-13T02:13:52.361122Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:51.838916+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:51.838916+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":"2209.03003","doi":"10.48550/arxiv.2209.03003","metadata_source":"pith","pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","venue":"cs.LG","work_id":"a1989e1b-d66d-4533-be3a-fb9c5fd62290","year":2022},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:17554171d234f68c0a733001d998be45340a69a9e7cc1b8fdd8f399b394b9ffa","observation_id":"11971ee5-d2a7-4401-80c1-70e72ef349de","resolution":{"observed_at":"2026-05-11T11:47:13.502948Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T22:49:29.244251+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T22:49:29.244251+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13349","last_updated":"2024-02-22T03:37:36Z","snapshot_observed_at":"2026-08-02T01:11:53.979449Z","submitted_at":"2024-02-20T19:53:15Z","title":"Aria Everyday Activities Dataset","version":2},"cited_work":{"arxiv_id":"2402.13349","doi":"10.48550/arxiv.2402.13349","metadata_source":"pith","pith_arxiv_id":"2402.13349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aria Everyday Activities Dataset","venue":"cs.CV","work_id":"62d6e2a2-edc5-4646-bdec-650c3321d5b3","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2402.13349","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:ac58c37c85bc7dd820c29ef2de2db1f8eca5378e4f18fd9a37353105ead6973d","observation_id":"ac15675f-1c1d-49db-9507-f04e02a2a6f2","resolution":{"observed_at":"2026-05-11T11:47:13.605860Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09905","last_updated":"2024-09-20T01:18:11Z","snapshot_observed_at":"2026-08-05T08:51:51.094594Z","submitted_at":"2024-06-14T10:23:53Z","title":"Nymeria: A Massive Collection of Multimodal Egocentric Daily Motion in the Wild","version":2},"cited_work":{"arxiv_id":"2406.09905","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.09905","snapshot_observed_at":"2026-07-03T15:58:37.503407Z","title":"Karen Liu, Ziwei Liu, Jakob Engel, Renzo De Nardi, and Richard Newcombe","venue":null,"work_id":"03277281-b4eb-49b7-bd73-e2214c9eb7a8","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2406.09905","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:db68161048b42fd467d817be30c7c1f3fd12a050923da8880a650b815dc8a2d2","observation_id":"e63078bb-e049-4f19-a926-4b2c073b8cf6","resolution":{"observed_at":"2026-05-11T11:47:13.829422Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2402.06196","doi":"10.48550/arxiv.2402.06196","metadata_source":"pith","pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Models: A Survey","venue":"cs.CL","work_id":"54e385fe-1786-48c3-8aa0-d727210eb50e","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:0b095e6502c463e753e5489e4452a29e1537640f0e3006bd5d3c420ad4c4b456","observation_id":"2a98c3c6-23a5-4087-bf01-5e0bdd6d6b15","resolution":{"observed_at":"2026-05-11T15:22:57.224432Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-07-06T20:15:22.511263Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:92b14720994504ddbf084be6808092bc675bac9017b156785f88d626379c7a30","observation_id":"f4c1f2d2-c6d2-4ab4-b7be-dd3b9369d595","resolution":{"observed_at":"2026-05-11T16:50:29.153357Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":"2304.07193","doi":"10.48550/arxiv.2304.07193","metadata_source":"pith","pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DINOv2: Learning Robust Visual Features without Supervision","venue":"cs.CV","work_id":"26b304e5-b54a-4f26-be7e-83299eca52e4","year":2023},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:920886a6a088e06cdbf442595a91d6955f25163d68f834a8813b6b9accee317f","observation_id":"7514cae9-3304-482e-b484-f16ba4632904","resolution":{"observed_at":"2026-05-11T11:47:14.175037Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":"2203.02155","doi":"10.1007/s00354-022-00198-8","metadata_source":"pith","pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training language models to follow instructions with human feedback","venue":"cs.CL","work_id":"52aff42f-4fa9-4fcf-bdb3-1459b9bebf65","year":2022},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:38410e0321076b4c441ee24086409128804e42960d588379b56b1c969896a995","observation_id":"43611c37-3396-4b46-9620-f3a6803d876a","resolution":{"observed_at":"2026-05-11T11:47:14.380352Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":"2308.12950","doi":"10.48550/arxiv.2308.12950","metadata_source":"pith","pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Code Llama: Open Foundation Models for Code","venue":"cs.CL","work_id":"e73bffa4-7620-47ac-9327-259a60db52ca","year":2023},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:9615b32a6e84282f7c8fd593d2234f6a4f7cebc40282c0c173e198483b38c861","observation_id":"2ce2abff-0536-411c-b391-dc2ffef69188","resolution":{"observed_at":"2026-05-11T11:47:14.575067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:36.742994+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:36.742994+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10224","last_updated":"2024-06-14T17:57:35Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:57:35Z","title":"EFM3D: A Benchmark for Measuring Progress Towards 3D Egocentric Foundation Models","version":1},"cited_work":{"arxiv_id":"2406.10224","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.10224","snapshot_observed_at":"2026-07-03T11:58:05.956985Z","title":"Xingyuan Sun, Jiajun Wu, Xiuming Zhang, Zhoutong Zhang, Chengkai Zhang, Tianfan Xue, Joshua B Tenenbaum, and William T Freeman","venue":null,"work_id":"51c2e6f9-245e-4a7b-93e7-76411a5e3314","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2406.10224","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:4f575ba2e6cf5705116f34868fe4b6d69c27740028c1b9f2d0583e7dbe882c22","observation_id":"1c4a2877-94bd-42f1-bd2a-9438d0c0374d","resolution":{"observed_at":"2026-05-11T11:47:14.775986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08448","last_updated":"2024-05-14T09:12:30Z","snapshot_observed_at":"2026-08-05T00:57:12.421643Z","submitted_at":"2024-05-14T09:12:30Z","title":"Understanding the performance gap between online and offline alignment algorithms","version":1},"cited_work":{"arxiv_id":"2405.08448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.08448","snapshot_observed_at":"2026-07-02T03:46:33.108981Z","title":"Understanding the performance gap between online and offline alignment algorithms","venue":null,"work_id":"92c35cdc-3e32-404d-a038-8a1f4228a044","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2405.08448","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:5b8a0c4b20e12e5d79a0e9dec464a0f944e27d1b256d7eecb505fa6db93943ee","observation_id":"e4117a2d-63ee-4a98-aa25-fcad9c1b0c49","resolution":{"observed_at":"2026-05-11T11:47:14.897036Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20512","last_updated":"2025-06-25T14:58:13Z","snapshot_observed_at":"2026-08-03T17:06:56.934769Z","submitted_at":"2025-06-25T14:58:13Z","title":"OctoThinker: Mid-training Incentivizes Reinforcement Learning Scaling","version":1},"cited_work":{"arxiv_id":"2506.20512","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.20512","snapshot_observed_at":"2026-07-04T13:59:51.967723Z","title":"Octothinker: Mid-training incentivizes reinforcement learning scaling","venue":null,"work_id":"89e55f68-3f36-40a1-bd9e-4bd253e3c1e9","year":2025},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2506.20512","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:8d5c8f073f72fdbec377def17b881d5c638754c366587dcb078ea1e1a7039112","observation_id":"939ad9d8-6458-47d3-a519-4c336360443d","resolution":{"observed_at":"2026-05-11T11:47:15.036120Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17412","last_updated":"2025-05-26T17:47:04Z","snapshot_observed_at":"2026-08-04T22:55:20.413619Z","submitted_at":"2025-05-23T02:58:01Z","title":"Direct3D-S2: Gigascale 3D Generation Made Easy with Spatial Sparse Attention","version":2},"cited_work":{"arxiv_id":"2505.17412","doi":"10.48550/arxiv.2505.17412","metadata_source":"pith","pith_arxiv_id":"2505.17412","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Direct3d-s2: Gigascale 3d generation made easy with spatial sparse attention","venue":"cs.CV","work_id":"a2a1ea9e-9ac0-45a0-9600-468e27e83389","year":2025},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2505.17412","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:519ffeffa877761ea7ce3286c0eaa3ad586cfea086118c568ba7cf86fdfc7126","observation_id":"c859e049-f9f4-41ed-b23a-04669e33e50d","resolution":{"observed_at":"2026-05-11T11:47:15.305891Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07143","last_updated":"2024-08-09T22:37:25Z","snapshot_observed_at":"2026-08-02T14:27:24.212588Z","submitted_at":"2024-04-10T16:18:42Z","title":"Leave No Context Behind: Efficient Infinite Context Transformers with Infini-attention","version":2},"cited_work":{"arxiv_id":"2404.07143","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.07143","snapshot_observed_at":"2026-07-10T01:36:44.083287Z","title":"Leave No Context Behind: Efficient Infinite Context Transformers with Infini-attention","venue":"cs.CL","work_id":"aecc8f73-1fd7-4a39-8ae7-a172b6a435b6","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2404.07143","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:4735c2f0bee76bee6b9adc30234a3ad6ac4fbb1403c4643e532d8d0f01c51eea","observation_id":"393e28ff-9663-47e2-aee5-94d91000b60a","resolution":{"observed_at":"2026-05-21T18:17:00.308428Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02293","last_updated":"2025-01-23T09:51:37Z","snapshot_observed_at":"2026-07-06T19:44:55.644262Z","submitted_at":"2024-11-04T17:21:42Z","title":"Hunyuan3D 1.0: A Unified Framework for Text-to-3D and Image-to-3D Generation","version":5},"cited_work":{"arxiv_id":"2411.02293","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.02293","snapshot_observed_at":"2026-07-08T01:44:26.255464Z","title":"Hunyuan3d-1.0: A unified framework for text-to-3d and image-to-3d generation","venue":"cs.CV","work_id":"71f653da-d853-4cc2-9927-f81513c7a416","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2411.02293","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:1ac7823b525403520ef12b8519f2df147fd973603840abee2859c68143966fe3","observation_id":"f059acdb-27a4-4078-a1f2-89baff7b63c7","resolution":{"observed_at":"2026-05-11T11:47:15.505962Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01825","last_updated":"2023-09-13T03:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-03T15:34:01Z","title":"Scaling Relationship on Learning Mathematical Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":"2308.01825","doi":"10.48550/arxiv.2308.01825","metadata_source":"pith","pith_arxiv_id":"2308.01825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Relationship on Learning Mathematical Reasoning with Large Language Models","venue":"cs.CL","work_id":"15eea2e2-dff3-42a7-842a-b663d50f64cb","year":2023},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2308.01825","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:21d32d3842fbd61487179b5be2f6c3c283af96423084e1120499fc824efc9ca4","observation_id":"be70ebdd-e8e5-4d01-9a18-4df89d1dd822","resolution":{"observed_at":"2026-05-15T00:22:11.212173Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-22T08:24:16.697802+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T08:24:16.697802+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06773","last_updated":"2023-10-10T16:49:21Z","snapshot_observed_at":"2026-08-05T16:12:03.689396Z","submitted_at":"2023-10-10T16:49:21Z","title":"Uni3D: Exploring Unified 3D Representation at Scale","version":1},"cited_work":{"arxiv_id":"2310.06773","doi":"10.48550/arxiv.2310.06773","metadata_source":"pith","pith_arxiv_id":"2310.06773","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Uni3d: Exploring unified 3d representation at scale","venue":"cs.CV","work_id":"90d21cdb-25b2-450c-8f61-7abddbbcf7e3","year":2023},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"cited_paper":"/paper/2310.06773","citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:b6e5fb91d67aa96fcb4b666941b310114664aaa279c2001d62aa72087f3d20c3","observation_id":"5cad7253-120f-44fb-877b-aebaf949c93b","resolution":{"observed_at":"2026-05-11T11:47:15.889271Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Left” (is better), “Right","venue":null,"work_id":"7dfde36a-0399-407b-9cac-c9b8db3404d4","year":2023},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:515b350316a83ea101950268a8725861e14613eecff473addb73e5418a8352f9","observation_id":"3b65c23e-80f7-463e-bd16-845137d86be6","resolution":{"observed_at":"2026-05-11T11:47:19.116078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"speed of the data flywheel","venue":null,"work_id":"6d298372-7b38-4f80-9e19-fddda0639a1f","year":2017},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:ec915b0e44cac882f210296efcc98f63bc6c227c03d9db97bb683b1b32453190","observation_id":"859fd3d9-4e14-4b88-bb0a-7f8a605d8198","resolution":{"observed_at":"2026-05-11T11:47:19.120440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"push into the tail","venue":null,"work_id":"69e81eae-007a-4b5d-b85c-a177a52cb717","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:963e67ee3442680b79f2457a2bb32eb5a9276f66a59e5526c6840fe452da8dc6","observation_id":"b3790338-b36e-4c57-8d39-c5a09cbf89ec","resolution":{"observed_at":"2026-05-11T11:47:19.123946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"This linearly scales the annotation time of preference data collection, and the selections themselves become noisier and more random due to choice overload (Diehl and Poynor, 2010)","venue":null,"work_id":"ad997b8a-9a25-4c8a-8a38-da50d60fe76f","year":2010},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:43b5fdeda4eeec477f7dc01eb5a1695e3cc2af25090d37f9c031452ad0be8287","observation_id":"61ac260b-8241-4d48-b1a3-88c223cdfa5d","resolution":{"observed_at":"2026-05-11T11:47:19.128136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fc14902b-7b26-45b5-bc97-d87a372616a0","year":2017},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:96c3a29c5fbfca272ab109e0c1b24a327802de17be01925da42bf77996f5d8ae","observation_id":"3980d5f2-7c9b-47e4-b152-596a7187cc19","resolution":{"observed_at":"2026-05-11T11:47:19.131708Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"face03d4-398d-4aff-9fbf-b26c80cbd98a","year":2023},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:0287de1ebb22e08d7b26d2bb0b932b866a35e975eb3501d0912a6a17a6d64c28","observation_id":"88843a2c-a640-4440-9ac5-3b9b39177c96","resolution":{"observed_at":"2026-05-11T11:47:19.135096Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"de-lighted","venue":null,"work_id":"fa975c25-ffbd-44a1-b7f3-7fac2bb322d5","year":2016},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:6a794ac1cb70e0440bf59ae5d17583d1ce13e30f5b2208ba6d7447e0179e9c50","observation_id":"42cfe8e0-8c34-4c22-bf72-e2dfe4633fd2","resolution":{"observed_at":"2026-05-11T11:47:19.138927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"shape-only), and when freezing shape capabilities and finetuning just for layout","venue":null,"work_id":"bc6583e4-7817-4346-b959-ab8963b80b6c","year":2022},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:87ce699ae19900b3ea36bc7033b88b780fdd2b53fead1ba8315f9a4866322ade","observation_id":"e0801c2a-2b9f-4d2d-a267-8fb8cf7b22bb","resolution":{"observed_at":"2026-05-11T11:47:19.175804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Implementation details.We apply DPO on shape prediction in the Geometry model and the predictions of the Texture & Refinement model","venue":null,"work_id":"0baab50e-6a53-4bc3-aa8e-ae5919cbbcab","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:a2361604baaa1073fada17c85ceac40d53a9d02f7c034c9a686d34a4b31fc87b","observation_id":"3c63f38c-7c2d-4d55-849e-ec3ae8aa055c","resolution":{"observed_at":"2026-05-11T11:47:19.211358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"de-lighted rendering","venue":null,"work_id":"1d406456-77a7-406c-86f2-2cc173f3e63e","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:b34ab4072644f029740be92edc9cc5bd157394096963c38dc9528a65729c5f4f","observation_id":"5df679a6-12a3-4efc-8d3d-b6c8d4300242","resolution":{"observed_at":"2026-05-11T11:47:17.695526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"C.6 Texture & Refinement VAE We make improvements over the original SLAT VAE design in Xiang et al","venue":null,"work_id":"1d55d5cf-a9cf-45c9-92d6-0abba99a5549","year":2025},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:37249a3ac0532310e0edf5a3cd843d3f00e5019d0d06a33598894d0f12c5b54e","observation_id":"3fa665f0-c5c3-449f-87ff-db097a525fdf","resolution":{"observed_at":"2026-05-11T11:47:17.814958Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Many rely on synthetic datasets (Deitke et al., 2023; Chang et al","venue":null,"work_id":"0f2a8026-bcc1-4ccb-8913-d9c63578bf63","year":2023},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:04cafd5d083385f9040f8876a9db5162ecb5bd56a490f970616bd522293e58e5","observation_id":"1d97357b-db2a-4eb6-aabc-a2e07ab24cfe","resolution":{"observed_at":"2026-05-11T11:47:18.055062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"This introduces a large visual gap with real-world evaluation conditions and the rich variation of real-world imagery","venue":null,"work_id":"58a42355-0083-4356-8a79-23fcc4077546","year":2024},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:59cff22ed9c0d92ef942170dc663e742fdcb1b08ba56130e231e7ede67d54846","observation_id":"e3cfb47e-09db-4e26-9d69-494751a14e04","resolution":{"observed_at":"2026-05-11T11:47:18.139936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A” vs. “B","venue":null,"work_id":"69982d31-ff73-4e7a-83e3-7574b880dda5","year":2023},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:ce1c8d4cf5e96f9c2542d89bba189533cc68860341c707efe2eaccc7fe468888","observation_id":"6038898d-4235-4a2e-b997-be46a0850372","resolution":{"observed_at":"2026-05-11T11:47:18.287343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f5c5e00c-9342-47b9-b813-3885b064d9e9","year":2023},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:6c0333e2d0cb81fc6a6b89bb433451923d9c4e9a36a00ff9aff35e59b1f1a5ba","observation_id":"3c60b3f1-d311-400b-baf5-0dd3f4162ae9","resolution":{"observed_at":"2026-05-11T11:47:18.378192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In this case, when the predicted and ground truth shape are the same, the asymmetric and symmetric versions of ADD-S coincide","venue":null,"work_id":"71d7412a-a748-49f1-8d00-f62301fcccb7","year":2027},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:80622469603993d628bbd9e4d2a47e3c69814419a7799de6f5e3b523c2e99ee3","observation_id":"20560e99-6972-4803-ae61-eb6a9a08873c","resolution":{"observed_at":"2026-05-11T11:47:18.485652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c3e6f2cb-ddbe-415a-aa31-5117dcd4b7d3","year":2025},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:45adca8501c8ed010a401f8a504b31f6949382f5f84c844ed24bda04d75e3265","observation_id":"18be2995-f811-4257-8024-55f4c0807844","resolution":{"observed_at":"2026-05-11T11:47:18.585412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"proposals","venue":null,"work_id":"5602b18d-63ac-4447-887f-7985a3eda8ad","year":2022},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:5e9b87359787b9a99479d09e62a403999dd3055ad312626084839d7532237fea","observation_id":"0fe1a402-025b-4dfd-87d4-6c983d959409","resolution":{"observed_at":"2026-05-11T11:47:18.854985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Further applying normalization to the 6D rotation vectors using the statistics over the training datasets leads to an additional improvement when training the flow matching models","venue":null,"work_id":"071621b1-ae0c-41d9-901f-0724b72a1574","year":2020},"citing_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-11T11:47:11.554134Z"},"links":{"citing_paper":"/paper/2511.16624"},"observation_digest":"sha256:995eec7c5591edd3afc7383808174f54122af809ccb8830cdb4a65f0787b6092","observation_id":"7c22f4d2-9bff-4bfe-b4b7-9acdeee2297d","resolution":{"observed_at":"2026-05-11T11:47:19.069203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":1,"metadata_mismatch":9,"parse_uncertain":0,"unresolved":4,"verified_exact":26,"verified_fuzzy":16},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 100 inbound Pith citation observations for arXiv:2511.16624."}