{"as_of":"2026-08-08T21:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37a737de2a598a86960d54ef558688a81388c69d4efd3868cb1bc7c7485ba2fb","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T19:57:00.411944Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.16805/citation-record","integrity":"/paper/2607.16805/integrity","json":"/paper/2607.16805/citation-record.json","paper":"/paper/2607.16805"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:54.336216Z","title":"Jones, Rajinder Sodhi, Michael Murdock, Ravish Mehra, Hrvoje Benko, Andrew D","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:54.336216Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:9b90278be162612315cb7f0296108d418cc786a3e54dbdc5b2f23a79a09638e9","observation_id":"a59c2d0c-525d-4bc3-bde9-71febf26328d","resolution":{"observed_at":"2026-08-01T19:56:54.336216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:54.452336Z","title":"Loop, Qin Cai, Philip A","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:54.452336Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:eff710f0fca50dea2ea06acbb449bdd60152f2e873b72864bbccf1d6bd46dad7","observation_id":"ad7284b5-6178-4849-a829-e017717a1035","resolution":{"observed_at":"2026-08-01T19:56:54.452336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:54.563783Z","title":"Newcombe, Shahram Izadi, Otmar Hilliges, David Molyneaux, David Kim, An- drew J","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:54.563783Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:d30ca253219eff3bc736d6bcb9a9fbb0f3995d829d880b7918643aebce58cb80","observation_id":"a363e52d-ff5e-4fa3-85eb-96eb868f4647","resolution":{"observed_at":"2026-08-01T19:56:54.563783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:54.733318Z","title":"Oasis: Procedurally generated social virtual spaces from 3d scanned real spaces.IEEE Trans","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:54.733318Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:f1ce6c631e51d6721f33063270cf07a084bc5ca774ba8be59a14ce3a73e9b384","observation_id":"3cf7632c-8e17-48c0-b7c4-60b5ca080a3b","resolution":{"observed_at":"2026-08-01T19:56:54.733318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.019269Z","title":"VR-NeRF: high- fidelity virtualized walkable spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.019269Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:0920b3b0ec75cd73bc602563236d35f5a7248fd339d38a31f593dfe41d1a803f","observation_id":"ccc4e2da-6556-4c67-961a-e0d74a54a377","resolution":{"observed_at":"2026-08-01T19:56:55.019269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.069783Z","title":"Litereality: Graphics-ready 3d scene reconstruction from RGB-D scans.Ad- vances in Neural Information Processing Systems, 38:162794–162827, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.069783Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:f9c30a872fe9e9e3fcc69dc98e3c270da23b282771cd8de01dc1c1c0f58b453c","observation_id":"b016486b-5d1e-465d-9d84-65985f9f9a68","resolution":{"observed_at":"2026-08-01T19:56:55.069783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.126006Z","title":"Robogen: Towards unleashing infinite data for automated robot learning via generative simulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.126006Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:5f58327b92fee9b7da4743099df993b8787e76889b7df4b64f13a64051acffb8","observation_id":"07d5e443-13ed-4806-90a0-9cd166888785","resolution":{"observed_at":"2026-08-01T19:56:55.126006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.198223Z","title":"Maniskill2: A unified benchmark for generalizable manipulation skills","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.198223Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:9816582380fd8ea0aa78d5e3d6e54e0d7ac5f22f17671b01fea5164748109cff","observation_id":"0a903fc2-843c-46f9-8ec3-1d1d0dd3e236","resolution":{"observed_at":"2026-08-01T19:56:55.198223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.274216Z","title":"Chang, and Manolis Savva","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.274216Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:99407e7474fd14fa78e6a7e8b17381a9c8aa32cbcb3ffc0d9daffe1ccaf3586d","observation_id":"6b991f87-774d-4c3f-8201-281d20267ba1","resolution":{"observed_at":"2026-08-01T19:56:55.274216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.418801Z","title":"Turner, Oleksandr Maksymets, Zsolt Kira, Mrinal Kalakrishnan, Jitendra Malik, Devendra Singh Chaplot, Unnat Jain, Dhruv Batra, Ak- shara Rai, and Roozbeh Mottaghi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.418801Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:70b3840739330d4b330864dca826ac306d78706ab472abf6a8eb0bd9af39f052","observation_id":"68a89fa2-4f7a-4b1a-8677-fe83d736aab4","resolution":{"observed_at":"2026-08-01T19:56:55.418801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.529323Z","title":"SQA3D: situated question answering in 3d scenes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.529323Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:7e5c0194a13ba846f782f04a9e4c3303ffa9baa6b4a7ae99572f4a5351013e45","observation_id":"489493e2-fac3-4ea3-8ed5-6581a1b67c42","resolution":{"observed_at":"2026-08-01T19:56:55.529323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.716067Z","title":"Openeqa: Embodied question answering in the era of foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.716067Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:abb9d0002433bf7dd9a71e9c266c9cba12f3b2d93601e20975d618c06a2f76fe","observation_id":"c85a2062-edf2-4dbd-9d14-ee7746f82974","resolution":{"observed_at":"2026-08-01T19:56:55.716067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:55.816755Z","title":"Structured 3d latents for scalable and versatile 3d generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.816755Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:31118cdb2cb5e252ea695805e0562b482b156c9af598f524e8418d9ebaaa1856","observation_id":"424c6d23-31f8-476b-abe9-73927676d422","resolution":{"observed_at":"2026-08-01T19:56:55.816755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12202","last_updated":"2026-05-14T15:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-21T15:16:54Z","title":"Hunyuan3D 2.0: Scaling Diffusion Models for High Resolution Textured 3D Assets Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12202","snapshot_observed_at":"2026-08-01T19:56:55.924884Z","title":"Hunyuan3d 2.0: Scaling diffusion models for high resolution textured 3d assets generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:55.924884Z"},"links":{"cited_paper":"/paper/2501.12202","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:6cc5d48f5dbe7d3ac6a003997697322c3e21801fb0219d55f43b4da91ece35f3","observation_id":"6f6c35f7-4bf4-42b5-b043-5af772be2832","resolution":{"observed_at":"2026-08-01T19:56:55.924884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:56.067836Z","title":"TriposG: high-fidelity 3d shape synthesis using large-scale rectified flow models.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:56.067836Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:b03b99742308b0803b2168cb63de94d830bf045ef22876eb84b78a5c3b479910","observation_id":"e4e9d686-74fb-4ea1-9046-2262bc06da59","resolution":{"observed_at":"2026-08-01T19:56:56.067836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-01T19:56:56.183385Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:56.183385Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:8c4f19b865a53d4bec20a0892a61359c2d0216e04c87d025884719dd0f071c26","observation_id":"18f7b8d0-6c5c-40c6-ade2-2e8ddefce8b4","resolution":{"observed_at":"2026-08-01T19:56:56.183385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:56.350417Z","title":"Multidiffusion: Fusing diffusion paths for controlled image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:56.350417Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:a1bb8c9cf9565abc49d5705be09a2b0cdd6620bc779cc20dbf274e08afec27fc","observation_id":"4bf7b04d-a278-457d-8322-4fc682eec9e1","resolution":{"observed_at":"2026-08-01T19:56:56.350417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:56.484172Z","title":"Reconviagen: Towards accurate multi-view 3d object reconstruction via generation.CoRR, abs/2510.23306, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:56.484172Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:6715857c63c579314a2f93f8b4e0732e1b90da05e7fd8afc0c895eba6eb8e038","observation_id":"3bbb8f48-dccf-4cf9-b935-987774abd147","resolution":{"observed_at":"2026-08-01T19:56:56.484172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:56.605684Z","title":"Besl and Neil D","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:56.605684Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:4d82780c81cfdaf088d8bf990469a5a82a9ae58089a28c40efedf640508e628b","observation_id":"0a41b0bc-0356-4491-8aea-3bc955eed8c0","resolution":{"observed_at":"2026-08-01T19:56:56.605684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05797","last_updated":"2019-06-13T16:29:58Z","snapshot_observed_at":"2026-08-01T13:51:16.469557Z","submitted_at":"2019-06-13T16:29:58Z","title":"The Replica Dataset: A Digital Replica of Indoor Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.05797","snapshot_observed_at":"2026-08-01T19:56:56.756917Z","title":null,"venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:56.756917Z"},"links":{"cited_paper":"/paper/1906.05797","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:5e9e6f31237857ebf963d657581bd1f18b2c1fb4ec77756f31e6868253c82d92","observation_id":"5746d648-abc9-4e1b-8f50-1b3dd95baf02","resolution":{"observed_at":"2026-08-01T19:56:56.756917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:56.910692Z","title":"Scannet++: A high-fidelity dataset of 3d indoor scenes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:56.910692Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:f729c8ca7e1a33d55196feccdbde5263f053db046f41e1e0b08682a6d58a0c43","observation_id":"01a6e1e6-7641-4bf7-8499-e9692c0271fe","resolution":{"observed_at":"2026-08-01T19:56:56.910692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.015372Z","title":"Amodal3r: Amodal 3d reconstruction from occluded 2d images","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.015372Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:dc1c9bddfbbf647feda10498c1c61e7ba9d0de896ff900e553782594ccd60c18","observation_id":"7c1f0bb9-e443-48eb-8bb9-2f51d028de21","resolution":{"observed_at":"2026-08-01T19:56:57.015372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07191","last_updated":"2024-04-14T16:54:24Z","snapshot_observed_at":"2026-07-06T17:58:25.894552Z","submitted_at":"2024-04-10T17:48:37Z","title":"InstantMesh: Efficient 3D Mesh Generation from a Single Image with Sparse-view Large Reconstruction Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07191","snapshot_observed_at":"2026-08-01T19:56:57.092983Z","title":"In- stantmesh: Efficient 3d mesh generation from a single image with sparse-view large reconstruc- tion models.CoRR, abs/2404.07191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.092983Z"},"links":{"cited_paper":"/paper/2404.07191","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:bbd2c04113f4a08ad4392f4fc4b4a0ee23bb2e8d61e643100d875d5cd8ab7846","observation_id":"d3472d3b-0e37-4a73-b515-3882d5a66cf6","resolution":{"observed_at":"2026-08-01T19:56:57.092983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.191837Z","title":"Pixel2mesh: Generating 3d mesh models from single RGB images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.191837Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:36bf715e12941667d988c1825c86653fb8d1945ab42e08d1066b53b2bf118e59","observation_id":"8b36c8d3-6884-4430-ae85-c162530b107c","resolution":{"observed_at":"2026-08-01T19:56:57.191837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.05567","last_updated":"2019-01-23T00:32:24Z","snapshot_observed_at":"2026-08-08T04:59:23.418695Z","submitted_at":"2019-01-17T00:00:58Z","title":"Soft Rasterizer: Differentiable Rendering for Unsupervised Single-View Mesh Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.05567","snapshot_observed_at":"2026-08-01T19:56:57.272294Z","title":"Soft rasterizer: Differentiable rendering for unsupervised single-view mesh reconstruction.CoRR, abs/1901.05567, 2019","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.272294Z"},"links":{"cited_paper":"/paper/1901.05567","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:e9cd418268163b3bcc8730ba7b679f01f754e8a691e869965d2eea0a23f2be28","observation_id":"ef954fae-d0dd-4330-9a9f-48c68afe7c33","resolution":{"observed_at":"2026-08-01T19:56:57.272294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.341700Z","title":"Neural 3d mesh renderer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.341700Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:3f13d69a8cf566dc07b2d3bc9f96aae554c20bc5a1c7ceba36716bfc8d5ca326","observation_id":"d17d56a2-2bf0-4bcf-bbfa-a100a154b066","resolution":{"observed_at":"2026-08-01T19:56:57.341700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.399071Z","title":"DISN: deep implicit surface network for high-quality single-view 3d reconstruction","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.399071Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:47e2ae6a7c2ac0b23eda952343751af9fbdcd7f38979cde5ffe5bb52e6b38541","observation_id":"789ac4af-6254-40a1-8826-c0cd89871fbe","resolution":{"observed_at":"2026-08-01T19:56:57.399071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.481640Z","title":"LRM: large reconstruction model for single image to 3d","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.481640Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:c6da61fa55cb215cefa8032ed92302559de91c4e2f7072ed65810219532d0a2f","observation_id":"a358c1e2-cc09-45fd-9a70-f7834a6b64da","resolution":{"observed_at":"2026-08-01T19:56:57.481640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.565127Z","title":"Direct3d: Scalable image-to-3d generation via 3d latent diffusion transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.565127Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:0557e7ef9965f75bf1678cea9107f7345574a3d7be5a3fab8d2350c8e459c17b","observation_id":"c9fd54ea-450d-4f7b-9e77-2dfebe8fcb41","resolution":{"observed_at":"2026-08-01T19:56:57.565127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.622102Z","title":"One-2-3-45: Any single image to 3d mesh in 45 seconds without per-shape optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.622102Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:6d26e1e1ca2411b9cfd01e1e57ea354adb922f3b23fef7914b1d9ccf22411f53","observation_id":"43ee7758-4615-4d92-b6cf-9d7e2d85ba0c","resolution":{"observed_at":"2026-08-01T19:56:57.622102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.724329Z","title":"CRM: single image to 3d textured mesh with convolutional reconstruction model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.724329Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:aac7da77f18c4569b592d4121d3b3b348355b1caef98795be2852eb97c7faaae","observation_id":"cdd750f0-5f7d-4529-ba75-20da92d8f0aa","resolution":{"observed_at":"2026-08-01T19:56:57.724329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.780214Z","title":"Wonder3d: Single image to 3d using cross-domain diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.780214Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:afaccba0223262b8c6ca45943475e2a666606b54f065c6a6aad17b48d9cd5a5b","observation_id":"dd2d2445-71da-4ccd-b8a3-c61ee363d44a","resolution":{"observed_at":"2026-08-01T19:56:57.780214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.884576Z","title":"Unique3d: High-quality and efficient 3d mesh generation from a single image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.884576Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:2a548ad68877f277e79eb1d108314d77cfecdb2d2d9053e608ea6e0a14cbb32c","observation_id":"1eb67e45-42c0-4180-994d-57487e71c125","resolution":{"observed_at":"2026-08-01T19:56:57.884576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:57.963894Z","title":"Objaverse-xl: A universe of 10m+ 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.963894Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:eaea25b9133b67fa0feeb9e52202af657e6909af5fe622dca9978472e74724ce","observation_id":"9dd810ee-73e1-410f-ba95-6583da469200","resolution":{"observed_at":"2026-08-01T19:56:57.963894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.021067Z","title":"Yago Vicente, Thomas Dideriksen, Himanshu Arora, Matthieu Guillaumin, and Jitendra Malik","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.021067Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:a0b90ad5b918f87875bac3d82e818b8c14f09371d6789bdbc5f75f37ab2b3740","observation_id":"8f57855d-c8a7-489b-b08a-6cf49f915b68","resolution":{"observed_at":"2026-08-01T19:56:58.021067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.102918Z","title":"MIDI: multi-instance diffusion for single image to 3d scene generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.102918Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:d12ff2d516ef2ba6c581e4c04f1b6a086fc7cfb69eb8abd055cda701a6059d70","observation_id":"b60a0c1e-2d5c-413d-959e-9cc899aebcf7","resolution":{"observed_at":"2026-08-01T19:56:58.102918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.172260Z","title":"Scenegen: Single-image 3d scene generation in one feedforward pass.CoRR, abs/2508.15769, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.172260Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:b3a5c4e2f46919dc56e44a4e0c514c8c399aa4bca5b137335bdaa2ade528d02f","observation_id":"b1244045-889b-4e53-bb49-5ef2eda1af10","resolution":{"observed_at":"2026-08-01T19:56:58.172260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.250180Z","title":"Scenemaker: Open-set 3d scene generation with decoupled de-occlusion and pose estimation model.CoRR, abs/2512.10957, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.250180Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:e37569125fa18022c60edecffc9243e85e8e813b505986f9391f38514545b34e","observation_id":"0f11126f-a38b-4162-b0f8-3efa70366b5e","resolution":{"observed_at":"2026-08-01T19:56:58.250180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.333232Z","title":"I-scene: 3d instance models are implicit generalizable spatial learners.CoRR, abs/2512.13683, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.333232Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:ec855e537a66da7e403e3837ddf38f3fdea5bf8aeff648e60501ed90ee816dc8","observation_id":"8823df9a-adc9-4d26-92e0-85138c9103d0","resolution":{"observed_at":"2026-08-01T19:56:58.333232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.412055Z","title":"Syncdreamer: Generating multiview-consistent images from a single-view image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.412055Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:e01669c6e9ee5ad83dbf522775265391c9e6b3f7671b8c0d9183207533fdcc2f","observation_id":"316db057-259b-40df-8f56-bdb175ca19e7","resolution":{"observed_at":"2026-08-01T19:56:58.412055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.488086Z","title":"SV3D: novel multi-view synthesis and 3d generation from a single image using latent video diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.488086Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:cfe26439606dcf24c3a3b9ef90222bc169b8468d496c0120d2d45c4228226bf6","observation_id":"4edbe80e-217f-4d94-89f4-c45376fcf1c0","resolution":{"observed_at":"2026-08-01T19:56:58.488086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.564972Z","title":"Ouroboros3d: Image- to-3d generation via 3d-aware recursive diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.564972Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:de95f8b5343d040a910729fe92b73a35701c77771b0e3ecf1c9303e2a80ead97","observation_id":"846d04ea-37e6-42e0-baf1-8a064ada965a","resolution":{"observed_at":"2026-08-01T19:56:58.564972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.01479","last_updated":"2026-04-03T02:02:55Z","snapshot_observed_at":"2026-08-08T07:52:55.097673Z","submitted_at":"2026-04-01T23:35:40Z","title":"UniRecGen: Unifying Multi-View 3D Reconstruction and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.01479","snapshot_observed_at":"2026-08-01T19:56:58.643810Z","title":"Unirecgen: Unifying multi-view 3d reconstruction and generation.arXiv preprint arXiv:2604.01479, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.643810Z"},"links":{"cited_paper":"/paper/2604.01479","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:473cf2186995f3a96a4deecb2739f68b0b46a858c1ae61259aa332c3e54e8402","observation_id":"f3d2c40d-316b-4a52-ba77-ce38debc712a","resolution":{"observed_at":"2026-08-01T19:56:58.643810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.718399Z","title":"Frost, Samir Aroudj, Armen Avetisyan, Henry Howard-Jenkins, Daniel DeTone, Pierre Moulon, Qirui Wu, Zhengqin Li, Julian Straub, Richard A","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.718399Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:ac086dac7ee96ff4540022d5e1c70894ea2dfe4adbfbaafd60401d8bd1297066","observation_id":"fa58a553-52e7-4ca8-9ccc-95766bcb30a9","resolution":{"observed_at":"2026-08-01T19:56:58.718399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.790224Z","title":"VGGT: visual geometry grounded transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.790224Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:a40ff727cf16100a9eda32eac2e5877f3025fff073fcc21019c9d74c7f9821c3","observation_id":"0cc8073a-888a-446b-8d43-02f90a55be88","resolution":{"observed_at":"2026-08-01T19:56:58.790224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.11633","last_updated":"2026-04-09T09:02:54Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T07:53:35Z","title":"MV-SAM3D: Adaptive Multi-View Fusion for Layout-Aware 3D Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.11633","snapshot_observed_at":"2026-08-01T19:56:58.847558Z","title":"MV- SAM3D: adaptive multi-view fusion for layout-aware 3d generation.CoRR, abs/2603.11633, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.847558Z"},"links":{"cited_paper":"/paper/2603.11633","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:948f6e668315b335c2f84af53f28763f695b7227649cac10ebc665e9980b88e6","observation_id":"bc07c80f-2b51-4cf2-b4ce-f0d80aac3016","resolution":{"observed_at":"2026-08-01T19:56:58.847558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:58.931951Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:58.931951Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:e78b4c9e4ba22804956dd4b05bc727564871c67abce0ffd59f4c819c317d1d3f","observation_id":"09d9dbca-f372-4b3f-9afd-db3f2057c504","resolution":{"observed_at":"2026-08-01T19:56:58.931951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.059177Z","title":"Flex3d: Feed-forward 3d generation with flexible reconstruction model and input view curation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.059177Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:5c6bb72b6d26a72e8ac58cc2387e27c7b18482348c7d378cd946f640aa9c54bd","observation_id":"af591367-65a2-4175-bb16-5b546068cccc","resolution":{"observed_at":"2026-08-01T19:56:59.059177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.164800Z","title":"A solution to the next best view problem for automated surface acquisition.IEEE Trans","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.164800Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:d3ea81f8d50fb4a320c7ce495ba949b91210862e7a5af7b74c47c31f47ef0f4a","observation_id":"bf0fa398-28d7-4b3c-a0f1-4d6d93ce551d","resolution":{"observed_at":"2026-08-01T19:56:59.164800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.333769Z","title":"Gammell, and Paul Newman","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.333769Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:d8393c5163997f6a57c72f39c5dada59f2b970d9eb6d497434490e720443ec85","observation_id":"d061eb67-c598-4730-8f65-fd9e90fc80f2","resolution":{"observed_at":"2026-08-01T19:56:59.333769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.441055Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.441055Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:e6f92cea5f2c912518169c4c053f1b57f26dcdcba74fe069f320f228dcd442bf","observation_id":"db88b412-033a-46e4-99ee-4f9564a65889","resolution":{"observed_at":"2026-08-01T19:56:59.441055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.546214Z","title":"Fisherrf: Active view selection and mapping with radiance fields using fisher information","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.546214Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:629a26aff91f82222322fd5809a5b1540b98840bc7faecbdcae8dc1bddc1e8b7","observation_id":"8c71992f-8ffe-494c-bf95-683afb53eb4b","resolution":{"observed_at":"2026-08-01T19:56:59.546214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.552386Z","title":"Pop-gs: Next best view in 3d- gaussian splatting with p-optimality","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.552386Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:0db0ff9339605facc17b82ad147094c06abb25b3d9a7691912682957810f3957","observation_id":"0806e89a-dd62-4723-8ef3-b0e071c8e993","resolution":{"observed_at":"2026-08-01T19:56:59.552386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.622202Z","title":"Next-best view policy for 3d reconstruction","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.622202Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:a485faa81aaf3a0f690b393141ebcafb35051591d35d38ca119fe49c31d774ae","observation_id":"1564e217-5b7f-439e-9b05-1c2073c0b295","resolution":{"observed_at":"2026-08-01T19:56:59.622202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:56:59.770128Z","title":"Gennbv: Generalizable next-best-view policy for active 3d reconstruction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.770128Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:e595908ef59cb2deeb4d843fb1f8520d579625cf14a4ba08fd59600e06004b9e","observation_id":"15572ef6-1305-4bf6-8e4b-f89bd90ddc0f","resolution":{"observed_at":"2026-08-01T19:56:59.770128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06219","last_updated":"2025-08-25T17:56:25Z","snapshot_observed_at":"2026-08-07T15:48:22.658581Z","submitted_at":"2025-05-09T17:54:10Z","title":"VIN-NBV: A View Introspection Network for Next-Best-View Selection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06219","snapshot_observed_at":"2026-08-01T19:56:59.902728Z","title":"VIN-NBV: a view introspection network for next-best-view selection for resource-efficient 3d reconstruction.CoRR, abs/2505.06219, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:59.902728Z"},"links":{"cited_paper":"/paper/2505.06219","citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:050aaa6d625d1e6c68d66410ab7376a6ef7557ec8ea66e358639ee2db314eb57","observation_id":"ccfa3443-de43-4632-a7b4-218e634e6fe6","resolution":{"observed_at":"2026-08-01T19:56:59.902728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:57:00.096647Z","title":"Decompositional neural scene reconstruction with generative diffusion prior","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T19:57:00.096647Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:e938307c1dce25b8d96b09afde18a2df66c8463a6f47d5fdce3d5c436418b500","observation_id":"0f0dac64-9d3c-44ff-a1f8-7aeca779cfaa","resolution":{"observed_at":"2026-08-01T19:57:00.096647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:57:00.252781Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T19:57:00.252781Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:89c1df5eb5ab51cb3c24e4fb0664e6abda0c670fa7e6afa82423e6201c07473d","observation_id":"e90c35e9-2f56-4831-8248-3d9897c1fe95","resolution":{"observed_at":"2026-08-01T19:57:00.252781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:57:00.411944Z","title":"k-means++: the advantages of careful seeding","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T19:57:00.411944Z"},"links":{"citing_paper":"/paper/2607.16805"},"observation_digest":"sha256:6c879781e000a10ada596bcf2d305c31eb26bb371041d7260d5cbe001d134c07","observation_id":"b3dbbfbe-44e2-423a-a1d1-cba0b16125f9","resolution":{"observed_at":"2026-08-01T19:57:00.411944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16805","last_updated":"2026-07-18T12:51:17Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T07:06:17.918584Z","submitted_at":"2026-07-18T12:51:17Z","title":"Scene-SAM3D: Multi-View Scene Asset Generation Without Fine-Tuning"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":59,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2607.16805."}