{"as_of":"2026-08-12T17:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d36dac894b2a49db154b8806fa59bf6c224d759c492dd71cc8b45725b724b7d6","coverage":[{"denominator":103,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:58:48.669334Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.11457/citation-record","integrity":"/paper/2412.11457/integrity","json":"/paper/2412.11457/citation-record.json","paper":"/paper/2412.11457"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.330010Z","title":"Omni3d: A large benchmark and model for 3d object detection in the wild","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.330010Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:083db5f054eecb5425d81af5ece045d01fb3dabd122e9a11ad20121b7a338780","observation_id":"cfe392d6-d1a0-477f-9ff1-b66e91a50d8e","resolution":{"observed_at":"2026-08-11T14:58:48.330010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.334088Z","title":"pixelsplat: 3d gaussian splats from image pairs for scalable generalizable 3d reconstruction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.334088Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:ddd289be159f226abd74947d11ac47c13370076c5837435c53a21456c928bc7b","observation_id":"e05a6b54-cdc7-4927-a298-dff066d135e6","resolution":{"observed_at":"2026-08-11T14:58:48.334088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.337797Z","title":"Scenetex: High-quality texture synthesis for indoor scenes via diffusion priors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.337797Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:dd3e7d58a3706a775753d4c0061e21a46e034bee52700410e5de84af87cd833c","observation_id":"761bb293-54b3-4b63-b5bd-e59551720448","resolution":{"observed_at":"2026-08-11T14:58:48.337797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.10972","last_updated":"2023-05-21T07:07:55Z","snapshot_observed_at":"2026-08-08T02:32:31.177380Z","submitted_at":"2023-01-26T07:37:22Z","title":"On the Importance of Noise Scheduling for Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.10972","snapshot_observed_at":"2026-08-11T14:58:48.341462Z","title":"On the importance of noise scheduling for diffu- sion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.341462Z"},"links":{"cited_paper":"/paper/2301.10972","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:b9f1157e4d160e511052706b686010b7137464ae5cb2e09656d9b15995cf03e8","observation_id":"b5a0119d-6323-4acc-af23-6ab7f5203d03","resolution":{"observed_at":"2026-08-11T14:58:48.341462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.346354Z","title":"Cascade-zero123: One image to highly consistent 3d with self-prompted nearby views","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.346354Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:eda1a35421e1f94c1743bbaa607fbed58ad0c3f65a31daad14fd02c23fa932c5","observation_id":"a7b307e3-4069-48ae-807e-79fd96d22be8","resolution":{"observed_at":"2026-08-11T14:58:48.346354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.350012Z","title":"Single-view 3d scene reconstruc- tion with high-fidelity shape and texture","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.350012Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:bef0622cbd45acf542c329f43a672c6c169d61ad1cfa479bba5a6b75ead66c1d","observation_id":"6a017c17-90d4-4a84-80d9-1d3de1f24d2c","resolution":{"observed_at":"2026-08-11T14:58:48.350012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.353805Z","title":"Comboverse: Compositional 3d assets creation using spatially-aware diffusion guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.353805Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:3d7403672f7739e765ea45912804baf6f325098226988dc3d2877397531efcbf","observation_id":"5f06ef78-75d6-47c9-a151-0822fb6f7c89","resolution":{"observed_at":"2026-08-11T14:58:48.353805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.357673Z","title":"Mvsplat: Efficient 3d gaussian splatting from sparse multi-view images","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.357673Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:514e2db7e18e5ed138a6af40c7617512d8a569935770f37934c8edd8fd838556","observation_id":"e9caf5f5-4a9c-4918-a0b4-3dd10b719da2","resolution":{"observed_at":"2026-08-11T14:58:48.357673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.361517Z","title":"Blender - a 3D modelling and rendering package","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.361517Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:0592f6a1392a56786f932feb235b7fd9ecd00f6f1851f24385a74cb2843a94dc","observation_id":"2780389a-47cf-4d35-992f-66e4c24ee143","resolution":{"observed_at":"2026-08-11T14:58:48.361517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.365164Z","title":"Anyskill: Learning open- vocabulary physical skill for interactive agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.365164Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:a66b8df34cc1cd78c46b79d215c7930007da4d6b643a517943ae535958e41a63","observation_id":"c85672b5-934f-4e0e-b518-ea060b0302ca","resolution":{"observed_at":"2026-08-11T14:58:48.365164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.368889Z","title":"Objaverse-xl: A universe of 10m+ 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.368889Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:b3271792beea20cd422806aa07325f9c59e3428688701cfdb82a82caa1798f28","observation_id":"36922264-6607-44fc-9666-d1709079124a","resolution":{"observed_at":"2026-08-11T14:58:48.368889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.372311Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.372311Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:93a3d763c1f68d9fd3bbf06c42c8b59fbfaa466b5f6ec9cb2d4ac1aa0f0b3543","observation_id":"b7f2ed2d-e08e-4fd9-a838-a981c076199b","resolution":{"observed_at":"2026-08-11T14:58:48.372311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.375588Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.375588Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:625abada4c6d5428cf7fa2fb8fba605739e66a962fb89d12a2562abf755a8778","observation_id":"2ed6a432-7503-43e1-82b3-e820e759b342","resolution":{"observed_at":"2026-08-11T14:58:48.375588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03421","last_updated":"2025-03-31T13:42:34Z","snapshot_observed_at":"2026-08-10T23:25:41.220157Z","submitted_at":"2024-04-04T12:58:46Z","title":"Gen3DSR: Generalizable 3D Scene Reconstruction via Divide and Conquer from a Single View","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03421","snapshot_observed_at":"2026-08-11T14:58:48.379565Z","title":"General- izable 3d scene reconstruction via divide and conquer from a single view","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.379565Z"},"links":{"cited_paper":"/paper/2404.03421","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:a67bd472423c8a87d6d296b934b6fb3aff7e95ddb52613961eb0e99ad6c9bc83","observation_id":"c7543ed9-31e4-46e3-8c0c-01d3cae2c39c","resolution":{"observed_at":"2026-08-11T14:58:48.379565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.383250Z","title":"3d-front: 3d furnished rooms with layouts and semantics","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.383250Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:fc3b4fd71639da87501006e102dff890ea209f99f6b1effbda3fc2b635ac48c7","observation_id":"7783aeff-3ec5-4897-8ece-6895bb24e113","resolution":{"observed_at":"2026-08-11T14:58:48.383250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.386784Z","title":"3d-future: 3d fur- niture shape with texture","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.386784Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:7b8b63c53610406abe8e5335975a18e5c930207c0603bbfda6091c712a5e76c7","observation_id":"19c1d0b1-2f6e-4dbb-9c23-09bdbd86deac","resolution":{"observed_at":"2026-08-11T14:58:48.386784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04321","last_updated":"2023-09-11T11:27:53Z","snapshot_observed_at":"2026-07-06T15:13:48.035348Z","submitted_at":"2023-04-09T21:42:57Z","title":"ARNOLD: A Benchmark for Language-Grounded Task Learning With Continuous States in Realistic 3D Scenes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04321","snapshot_observed_at":"2026-08-11T14:58:48.390173Z","title":"Arnold: A benchmark for language-grounded task learning with continuous states in realistic 3d scenes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.390173Z"},"links":{"cited_paper":"/paper/2304.04321","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:295757eed2d5fe7e4ac6cec44efb9509ffa6fc4c977a85182765497cff0faacb","observation_id":"b7fbf83e-5c97-4025-a0aa-13971d367bec","resolution":{"observed_at":"2026-08-11T14:58:48.390173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13788","last_updated":"2024-12-19T17:51:42Z","snapshot_observed_at":"2026-08-10T12:27:58.880216Z","submitted_at":"2024-03-20T17:51:53Z","title":"DepthFM: Fast Monocular Depth Estimation with Flow Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13788","snapshot_observed_at":"2026-08-11T14:58:48.393874Z","title":"Depthfm: Fast monocular depth estimation with flow matching","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.393874Z"},"links":{"cited_paper":"/paper/2403.13788","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:22390a598b84c4d1f7c012fb869020dbacdf005a2dac14fde7889e8ec34e40d5","observation_id":"20173af1-b389-4458-82f1-830fba100cb8","resolution":{"observed_at":"2026-08-11T14:58:48.393874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.397520Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.397520Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:5536ee0726908651a3c4c0a5e7d0bb221bc9794f55205320b5a4fa990a4616b6","observation_id":"9bf00527-d096-4cf6-9740-469d181fd149","resolution":{"observed_at":"2026-08-11T14:58:48.397520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.400996Z","title":"Text2room: Extracting textured 3d meshes from 2d text-to-image models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.400996Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:5370f47ffe9c6a9fffe6dfaf9d9d9a3cabe40bef1c741af60aea83bbd54f5746","observation_id":"130053ed-8ace-49d2-8c55-bcdb2bac4b85","resolution":{"observed_at":"2026-08-11T14:58:48.400996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.404267Z","title":"An embodied generalist agent in 3d world","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.404267Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:bcc50deb3326340d396b0abbddad1abc4b178bc68d4ce15a4d4853dd61fedbdd","observation_id":"d80e61b6-b9ad-423a-bd80-2b6910a6ec8f","resolution":{"observed_at":"2026-08-11T14:58:48.404267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.407228Z","title":"Unveiling the mist over 3d vision-language under- standing: Object-centric evaluation with chain-of-analysis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.407228Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:acbc82fa03d0a4f58d51ee15a096288d14a45004fb4b185698f009bf3f729880","observation_id":"3e94c9a1-c2db-48ed-89b7-902a3d03fe44","resolution":{"observed_at":"2026-08-11T14:58:48.407228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.410450Z","title":"Epidiff: Enhancing multi-view synthesis via localized epipolar-constrained diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.410450Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:9d5f56b6ea4c62e2fa33be6964488968c33bff384ec33bd3f466dbabe4cf26f7","observation_id":"0c2eb99e-c551-4b28-92e2-e32b3665b605","resolution":{"observed_at":"2026-08-11T14:58:48.410450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16778","last_updated":"2025-03-28T21:52:16Z","snapshot_observed_at":"2026-08-11T10:13:19.038917Z","submitted_at":"2024-12-21T21:22:01Z","title":"RoomPainter: View-Integrated Diffusion for Consistent Indoor Scene Texturing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16778","snapshot_observed_at":"2026-08-11T14:58:48.413761Z","title":"Roompainter: View-integrated diffusion for consistent indoor scene texturing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.413761Z"},"links":{"cited_paper":"/paper/2412.16778","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:f8e68775c96eb44165f0eb84d97dbea579d152f43782a0c1bce336a155d63e97","observation_id":"6b46e4d0-6ac1-480c-a5ac-ce0fe76b6f6a","resolution":{"observed_at":"2026-08-11T14:58:48.413761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.417268Z","title":"Putting nerf on a diet: Semantically consistent few-shot view synthe- sis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.417268Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:2adb5f15207d7dfbff1e8d5a0680365dd3979f4f165e1b38acc4b26b910614fd","observation_id":"98a1eb1a-50f6-45e4-9160-a17856a00be4","resolution":{"observed_at":"2026-08-11T14:58:48.417268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.420261Z","title":"Zero-shot text-guided object gener- ation with dream fields","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.420261Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:e3ac3f4e5a2655dac77ca6001409c26601ad4a788fce73d275d13a1df1016b6b","observation_id":"35c7acd4-5281-487b-9da9-444b0705e171","resolution":{"observed_at":"2026-08-11T14:58:48.420261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.423617Z","title":"Sceneverse: Scaling 3d vision-language learning for grounded scene understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.423617Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:3f7b2a5ae57315bea09b8b93823b6c01c258d484dd2616dd2cb5e00dd4af1b26","observation_id":"b51a8801-74c9-4bbf-a9c0-6cf6ddd05430","resolution":{"observed_at":"2026-08-11T14:58:48.423617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.427111Z","title":"Autonomous character-scene interaction synthesis from text instruction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.427111Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:5a4af4a40316049a8c0a7a1d9a020a4d24d34f7fdc96ca6a4e4c521300361426","observation_id":"a1645a1b-a5b9-4c3d-b969-5b228bae92c3","resolution":{"observed_at":"2026-08-11T14:58:48.427111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.491999Z","title":"Scaling up dynamic human-scene interaction model- ing","venue":null,"work_id":"db31d7ea-3157-4f7d-913c-4d3cda164226","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.430444Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:f139d96a0a84b1a293af5f92d18d26d1f2852ce41b76662e348736a35056514d","observation_id":"685787a8-d1d8-4690-b097-f6c15c8c12f9","resolution":{"observed_at":"2026-08-11T14:58:49.495024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03015","last_updated":"2023-10-04T17:57:07Z","snapshot_observed_at":"2026-08-06T06:07:24.190733Z","submitted_at":"2023-10-04T17:57:07Z","title":"Efficient-3DiM: Learning a Generalizable Single-image Novel-view Synthesizer in One Day","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03015","snapshot_observed_at":"2026-08-11T14:58:48.433548Z","title":"Efficient- 3dim: Learning a generalizable single-image novel-view synthesizer in one day","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.433548Z"},"links":{"cited_paper":"/paper/2310.03015","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:152f7e1aba2e69f356f0633f3cfb49684e9305acdd9fc479743c9889a1597458","observation_id":"0063f61d-a1d8-4f60-b5f7-c29d63c10f19","resolution":{"observed_at":"2026-08-11T14:58:48.433548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.482197Z","title":"Repurpos- ing diffusion-based image generators for monocular depth estimation","venue":null,"work_id":"956f9951-0300-4987-9678-06712fa18c63","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.437488Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:8f3a83c55cc56da1fd2f0e41d95cf1c64c610fc275ecb95851f12dcc43774077","observation_id":"208223de-9171-4092-b746-8b743597257b","resolution":{"observed_at":"2026-08-11T14:58:49.485869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.472130Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":"a8b80e97-dfea-4bbf-9aa8-2962115cdb84","year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.440936Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:0b2771b7eea84c590f411044bf604fa12ff4c4e56ad27f3fc90b36c8e279910b","observation_id":"8b7ae2e3-f9f0-4d65-bc91-1e3e56cf7836","resolution":{"observed_at":"2026-08-11T14:58:49.475969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.462500Z","title":"Segment anything","venue":null,"work_id":"f4d855f6-7e66-4d9b-91e4-6ef40bd9f1f7","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.444622Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:0a1a685c1d2d3ea9bedb7f4d04b3777850e218d6e433b22a59bce69f7fea8ae1","observation_id":"ed37adfc-3dc3-493c-982d-7ec90d7f1524","resolution":{"observed_at":"2026-08-11T14:58:49.465995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.452692Z","title":"Eschernet: A generative model for scalable view synthesis","venue":null,"work_id":"2e3cea28-c815-4057-9fc0-096140064459","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.447978Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:a8d700f07a7691ba60a4b79a6c818829d7364794928deda6affded4c27dff081","observation_id":"6f523239-9369-4096-855c-2986ccfb97c7","resolution":{"observed_at":"2026-08-11T14:58:49.456336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.443137Z","title":"Ground- ing image matching in 3d with mast3r","venue":null,"work_id":"24dc42ba-ac65-4d63-876f-0b434705c590","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.451211Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:d6c27e1d1a1ef5139e4f72325da483982897e3fb65103990295910e615474511","observation_id":"02e71eb2-54a7-4309-976b-a167601daed0","resolution":{"observed_at":"2026-08-11T14:58:49.446586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.432840Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"0864f3c4-66b1-4699-be23-31973ed8c2e4","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.454551Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:74a910341b6e4d41af688815cffce69c9df30f8a2bb77205aa718fa6077318c2","observation_id":"0176c219-3939-4b3d-b98c-5553bf5d4c74","resolution":{"observed_at":"2026-08-11T14:58:49.436690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.421877Z","title":"Gendexgrasp: General- izable dexterous grasping","venue":null,"work_id":"2b1b1305-6c6c-40ca-8aa0-02ce1f29ba45","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.457978Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:287ba62789ebb1af427ed53bb66a2bc2fb8e3ca92eb63417846261b6a50ebecc","observation_id":"cba8d3bb-dcb8-44ce-9e47-64bb6d38b4f5","resolution":{"observed_at":"2026-08-11T14:58:49.425588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.411222Z","title":"Ag2manip: Learning novel manipulation skills with agent- agnostic visual and action representations","venue":null,"work_id":"45117084-78b7-40ae-bad3-e8609ea3ba45","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.461251Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:f0501c90af2bd4870f73d2b73bce76b1f68f74803eb46a2ea2138e1d30aaba28","observation_id":"6112a08e-bc9b-4597-a601-a8f1452894ca","resolution":{"observed_at":"2026-08-11T14:58:49.415047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07078","last_updated":"2024-12-28T05:41:37Z","snapshot_observed_at":"2026-08-01T06:45:31.236085Z","submitted_at":"2024-10-09T17:23:04Z","title":"FlowBotHD: History-Aware Diffuser Handling Ambiguities in Articulated Objects Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07078","snapshot_observed_at":"2026-08-11T14:58:48.464582Z","title":"Flowbothd: History-aware diffuser handling ambiguities in articulated objects manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.464582Z"},"links":{"cited_paper":"/paper/2410.07078","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:817073b012ac389d86847102327b9f04e280f7bce6bdaa66f0c733f81cf815e8","observation_id":"f20bc489-37f5-4492-9ac8-4d0dd6899a5e","resolution":{"observed_at":"2026-08-11T14:58:48.464582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.401137Z","title":"Grasp multi- ple objects with one hand","venue":null,"work_id":"9bec7384-b4d4-4239-ba69-cc8c384fbbda","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.468335Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:7135950968575a93068ed1a358ba0cb397ee0d38fc4b90bc28293914d56b3b69","observation_id":"fedc6044-715e-4d5d-83ad-34acd74d0acb","resolution":{"observed_at":"2026-08-11T14:58:49.405115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.390795Z","title":"Magic3d: High-resolution text-to-3d content creation","venue":null,"work_id":"6bb8dccb-dfde-4c52-8faa-4782d62d3bee","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.471427Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:c3a39d57837e9d222440149ee39cbcf071ad5c7e7909fc50d29e27718e37bcea","observation_id":"77b051b8-d0d5-4a96-86f1-e5690f900ae2","resolution":{"observed_at":"2026-08-11T14:58:49.394351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.381219Z","title":"Consistent123: One image to highly consistent 3d asset using case-aware diffusion priors","venue":null,"work_id":"e28e8c12-3d02-47b2-9273-ca8273c0d619","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.474635Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:4bd7cb71dee0f67f9d406d2bb960bcfa58e72c49f8ec15ad9003c84e77595222","observation_id":"95f2e7da-807d-4261-9939-e971f2e47b63","resolution":{"observed_at":"2026-08-11T14:58:49.384719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.371120Z","title":"Multi-modal situated reasoning in 3d scenes.Advances in Neural Information Pro- cessing Systems (NeurIPS), 2024","venue":null,"work_id":"905bb65b-baf3-4c6e-98ac-8baec3799e66","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.477902Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:e847ad67f395c6b332382513677d4e5bc3c96fe9de6205a12b3c7806a660d13b","observation_id":"fd675dd1-24b5-41a4-a001-748cbb07fcb1","resolution":{"observed_at":"2026-08-11T14:58:49.374512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.361632Z","title":"One-2-3-45: Any single image to 3d mesh in 45 seconds without per-shape optimiza- tion","venue":null,"work_id":"fed8f927-7e66-4149-88d4-f61aab6f0bc3","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.480982Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:572c5c8713dd691e9af2136a2b9343affa35ebf3eeac6e0c8cbd8328127012a2","observation_id":"f5425424-61ee-496d-91a2-c9ecedf947e3","resolution":{"observed_at":"2026-08-11T14:58:49.365019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.351277Z","title":"One-2-3-45++: Fast single image to 3d objects with consistent multi-view generation and 3d diffusion","venue":null,"work_id":"1a128dd8-40c4-4c80-a704-ee5d9d3c4eaa","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.484247Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:9b1cf309fb834425ff6c92801fffd4a6c86b4e0753b9bf89a47b866a0c6ee919","observation_id":"db482454-0462-4fc3-a62a-18154f29abf7","resolution":{"observed_at":"2026-08-11T14:58:49.355018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.339993Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":"2e2c8e36-e967-45ae-94d4-90eb18e51f99","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.487419Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:3ec2c130d534e53c0647c293e28a4bb7507fbeea302db36b05bf13d141905478","observation_id":"2ed4584e-0ab3-4894-8333-80ad551befd3","resolution":{"observed_at":"2026-08-11T14:58:49.344072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03453","last_updated":"2024-04-15T10:28:44Z","snapshot_observed_at":"2026-07-06T16:15:31.848927Z","submitted_at":"2023-09-07T02:28:04Z","title":"SyncDreamer: Generating Multiview-consistent Images from a Single-view Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03453","snapshot_observed_at":"2026-08-11T14:58:48.490863Z","title":"Syncdreamer: Gen- erating multiview-consistent images from a single-view im- age","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.490863Z"},"links":{"cited_paper":"/paper/2309.03453","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:8414cb5ce81121ac9b588fb6b87a527e8ecb5baa6ed94db850db5efdc105b681","observation_id":"3f7ff390-6cff-4686-8d8a-acd2f62c39c3","resolution":{"observed_at":"2026-08-11T14:58:48.490863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.329365Z","title":"Slotlifter: Slot-guided feature lifting for learning object- 10 centric radiance fields","venue":null,"work_id":"0a90fdf3-4c20-4af1-9f66-1119e140a508","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.494617Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:f88116f4a68972bd9b94ba48517b8e670da71ff57bdd570aeae45d5fd836482f","observation_id":"c707ed77-cf9a-4808-898b-fa9a27c8b2ac","resolution":{"observed_at":"2026-08-11T14:58:49.333050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19459","last_updated":"2025-03-19T08:43:16Z","snapshot_observed_at":"2026-08-07T17:47:15.321615Z","submitted_at":"2025-02-26T10:25:32Z","title":"ArtGS: Building Interactable Replicas of Complex Articulated Objects via Gaussian Splatting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19459","snapshot_observed_at":"2026-08-11T14:58:48.497863Z","title":"Building interactable replicas of complex articulated objects via gaussian splatting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.497863Z"},"links":{"cited_paper":"/paper/2502.19459","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:54b3d0191922d1edd02bb49b9fdbebe61fa17f79ab03b64cb7764be7fde0d3bd","observation_id":"cc661913-f8b4-4729-aa81-9bb746e73427","resolution":{"observed_at":"2026-08-11T14:58:48.497863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.501483Z","title":"Wonder3d: Sin- gle image to 3d using cross-domain diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.501483Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:b2acace9d3815e10cbfe59101aea24a829f190ce811bb1da047fcbf784b3d003","observation_id":"6700387f-f707-4047-bff9-ba6949ee4ad1","resolution":{"observed_at":"2026-08-11T14:58:48.501483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.312452Z","title":"Manigaussian: Dynamic gaus- sian splatting for multi-task robotic manipulation","venue":null,"work_id":"ba3e23bd-29e2-4da3-ad29-a056131d2bab","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.504696Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:759601632381b1a04d3ffc16d6539e789fe90657ff68e4548dc3e658d216f1d1","observation_id":"7f55ae47-31e7-4285-aac8-c7945be34766","resolution":{"observed_at":"2026-08-11T14:58:49.316239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12049","last_updated":"2025-08-04T14:59:28Z","snapshot_observed_at":"2026-08-07T17:02:14.677646Z","submitted_at":"2025-03-15T08:47:45Z","title":"TACO: Taming Diffusion for in-the-wild Video Amodal Completion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12049","snapshot_observed_at":"2026-08-11T14:58:48.507473Z","title":"Taco: Taming diffusion for in-the-wild video amodal completion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.507473Z"},"links":{"cited_paper":"/paper/2503.12049","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:3b25990fd8f862dece1a654702abc43d73c27fc078a05b1394730347ccc48408","observation_id":"bf918113-275c-4ba9-9cb9-cb1d3adccc7c","resolution":{"observed_at":"2026-08-11T14:58:48.507473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.301803Z","title":"Repaint: Inpainting using denoising diffusion probabilistic models","venue":null,"work_id":"8e6ec828-2a38-47b9-bc6e-df07509a60a0","year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.510496Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:4eec0c01b9e7503a439947198aeec53c1b1c0ba7d0c8c0f874d7247f4dfff1e6","observation_id":"d87f0023-53eb-4f46-94c7-7ff6aaa5273d","resolution":{"observed_at":"2026-08-11T14:58:49.305917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07376","last_updated":"2025-02-14T22:53:14Z","snapshot_observed_at":"2026-08-09T21:41:25.497275Z","submitted_at":"2024-02-12T02:16:59Z","title":"Unsupervised Discovery of Object-Centric Neural Fields","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07376","snapshot_observed_at":"2026-08-11T14:58:48.513419Z","title":"Unsuper- vised discovery of object-centric neural fields.arXiv preprint arXiv:2402.07376, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.513419Z"},"links":{"cited_paper":"/paper/2402.07376","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:0efad2b1fc8d492ec15200860baba4c0bddb62a1fb6408236094e0a013746365","observation_id":"3b7ba7ae-faa0-47e3-8e2e-39d3d5ebbc9d","resolution":{"observed_at":"2026-08-11T14:58:48.513419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.291133Z","title":"Realfusion: 360deg reconstruction of any object from a single image","venue":null,"work_id":"f5f8b789-7eef-4017-95bd-f1a9cbc084c9","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.516282Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:5696b4e55a29ddad5277c52ba69b2388d9159366b46e439894694960fbfde361","observation_id":"05184574-3ee2-48e6-bf35-fe02f7fd8767","resolution":{"observed_at":"2026-08-11T14:58:49.295177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.519191Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.519191Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:015006ca8f90289fc64d8ae57d2345e877f5ee7e686bf14021385447dd52b79a","observation_id":"c8644b56-0ccc-4504-b6eb-1c61c3704174","resolution":{"observed_at":"2026-08-11T14:58:48.519191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.274411Z","title":"Phyrecon: Physically plausible neural scene recon- struction","venue":null,"work_id":"eb8624c1-8bd0-401a-8688-b4cfd9b98d61","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.521872Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:33401b86b1c94d9134f4cc9183d98c32d6266595f154552f4e9584ab43c43452","observation_id":"d9665b85-672a-47fd-8a38-3c8022831e11","resolution":{"observed_at":"2026-08-11T14:58:49.278029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.253475Z","title":"Decompositional neu- ral scene reconstruction with generative diffusion prior","venue":null,"work_id":"49cedf97-68aa-469e-a76d-72eea01bc5e6","year":2025},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.524558Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:b6019fb0aa7ba521d97c4a1055735dca998773fb0be9e2cb203861767da1b7a3","observation_id":"b50f9bcf-7ca8-4619-b811-15c8c8bc6254","resolution":{"observed_at":"2026-08-11T14:58:49.257488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.243050Z","title":"Total3dunderstanding: Joint lay- out, object pose and mesh reconstruction for indoor scenes from a single image","venue":null,"work_id":"51e1e8ed-e679-4b87-83cd-0a946707b2da","year":2020},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.527263Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:e650d848c6f2d755bbe71fa736cbdcb9e38d7d1c3fe3cc54f6b1caa887a874b1","observation_id":"bd254085-f9c5-446f-908d-cdc70b2be567","resolution":{"observed_at":"2026-08-11T14:58:49.247010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-11T14:58:48.530488Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.530488Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:1733eab69e82a5af153af1bee8d8114ca75fdeb603ca3bcfaa2b5ebc77edfd36","observation_id":"02fdfef7-c6ae-4abc-bf2b-0e37a971a7bd","resolution":{"observed_at":"2026-08-11T14:58:48.530488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.232976Z","title":"pix2gestalt: Amodal segmentation by synthesizing wholes","venue":null,"work_id":"78cdb1b4-8ba5-418a-bc4d-5cedc9e06474","year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.534370Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:c0f50246b77a8c416eba0a2c8f66251679ecf0bd2eea9939142362da42a390b7","observation_id":"48184d54-c8e1-482a-b634-e000fe00e3fb","resolution":{"observed_at":"2026-08-11T14:58:49.236181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-11T14:58:48.537644Z","title":"Dreamfusion: Text-to-3d using 2d diffusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.537644Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:d6e7a4c1497e23ca777f152d7d459ed57062acda136368f82cff6b9f5e75d798","observation_id":"e4448c60-fe82-4e09-a3e8-0fc8dad97d26","resolution":{"observed_at":"2026-08-11T14:58:48.537644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17843","last_updated":"2023-07-23T21:27:30Z","snapshot_observed_at":"2026-08-07T04:14:20.139990Z","submitted_at":"2023-06-30T17:59:08Z","title":"Magic123: One Image to High-Quality 3D Object Generation Using Both 2D and 3D Diffusion Priors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17843","snapshot_observed_at":"2026-08-11T14:58:48.540876Z","title":"Magic123: One image to high-quality 3d object generation using both 2d and 3d diffusion priors.arXiv preprint arXiv:2306.17843,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.540876Z"},"links":{"cited_paper":"/paper/2306.17843","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:243b2b99a36d196b845d748558e3afd5fe84a87506d46e8722262eb313a7b525","observation_id":"3368c432-0813-41e0-a9fb-635dd46383c6","resolution":{"observed_at":"2026-08-11T14:58:48.540876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.223174Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"948c3817-dc2d-4bdb-92bb-a6e2cfb1805b","year":2021},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.544636Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:53bafb1cc1e18a8024497a6826c12b19cc14ad212b7cb3f1ec0fa5ffa12bba41","observation_id":"ad3b527e-31d1-413b-9f14-aa3a75afb20e","resolution":{"observed_at":"2026-08-11T14:58:49.226775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.213348Z","title":"Language embedded radiance fields for zero-shot task- oriented grasping","venue":null,"work_id":"8338ceb8-004b-4883-91b4-14bb1c55cb04","year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.547846Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:c0ce25cc78d5686bd80a532de71a2908effa4ec735594cf77720157dced9aae7","observation_id":"7ca5c1cf-145d-4a37-81d1-9ddeb4181ecc","resolution":{"observed_at":"2026-08-11T14:58:49.216984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.204187Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"024a2065-f8e8-4358-a77f-7f8cb1a9e725","year":2022},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.551090Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:e4a35a86386480712e4143a9a37d0b4f9f3e1bfa9495dbfaa988bf278a5df846","observation_id":"4d42f4b3-170c-4d70-acba-37801d0f3133","resolution":{"observed_at":"2026-08-11T14:58:49.207844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.194716Z","title":"Zeronvs: Zero-shot 360- degree view synthesis from a single image","venue":null,"work_id":"5083f86a-bf34-4289-b2f1-c1a26b0f304c","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.554302Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:694ca36bbb1fd5f99b99fc675726ab78ee99c1fc77abac528bc0217d35865507","observation_id":"295bea2a-8d77-4762-bb1a-d7cebdcf0492","resolution":{"observed_at":"2026-08-11T14:58:49.198123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15110","last_updated":"2023-10-23T17:18:59Z","snapshot_observed_at":"2026-08-11T13:07:00.745167Z","submitted_at":"2023-10-23T17:18:59Z","title":"Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15110","snapshot_observed_at":"2026-08-11T14:58:48.557616Z","title":"Zero123++: a single image to consistent multi-view dif- fusion base model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.557616Z"},"links":{"cited_paper":"/paper/2310.15110","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:719bf9df10046255d2d882dec4fec84ab9c6861d5e3922fadca9634051ef413a","observation_id":"7b6ea471-9e84-4e20-ab68-ab782135a2e5","resolution":{"observed_at":"2026-08-11T14:58:48.557616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-07-06T16:12:38.269310Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-11T14:58:48.561316Z","title":"Mvdream: Multi-view diffusion for 3d gen- eration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.561316Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:5659fb0ea1cb0e4cb8afa283424b4e47da794ac5a8330f96460ef9d8e47d2ffd","observation_id":"748f95ab-cd5d-41e0-bfbd-d39d316c40d3","resolution":{"observed_at":"2026-08-11T14:58:48.561316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.184924Z","title":"Denois- ing diffusion implicit models","venue":null,"work_id":"99837768-a869-45d4-8300-d8d5d989f42e","year":2020},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.565002Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:c57fc96417089b21d8de9d692e631f8f99d6046280bda6ff3a423b5d182cf24b","observation_id":"574bb7aa-5438-4fc0-bbb9-0dcde12f5c09","resolution":{"observed_at":"2026-08-11T14:58:49.188527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.174530Z","title":"Sun rgb-d: A rgb-d scene understanding benchmark suite","venue":null,"work_id":"8d3c3a58-d125-4a5f-9dad-498a9696820a","year":2015},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.568189Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:fd6d7a2a63931a4eaaf8e9b3799698fad2bb6c63ca5ebc90ccfb5b63334eae35","observation_id":"1793577b-26c8-4e74-9375-296d17c526bf","resolution":{"observed_at":"2026-08-11T14:58:49.178133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16653","last_updated":"2024-03-29T08:39:23Z","snapshot_observed_at":"2026-07-06T16:25:05.493379Z","submitted_at":"2023-09-28T17:55:05Z","title":"DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16653","snapshot_observed_at":"2026-08-11T14:58:48.571738Z","title":"Dreamgaussian: Generative gaussian splatting for effi- cient 3d content creation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.571738Z"},"links":{"cited_paper":"/paper/2309.16653","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:deafb1c9fb1c61fecb71dd5cff51e2ea504aafb984b3680b6aa79e54a081a60b","observation_id":"418a93e9-3ddb-4c46-8154-49584fe6cc4c","resolution":{"observed_at":"2026-08-11T14:58:48.571738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.164660Z","title":"Make-it-3d: High-fidelity 3d 11 creation from a single image with diffusion prior","venue":null,"work_id":"d25279b4-4e0c-488a-8e62-7bf2dfc700db","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.575426Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:9314855db2a28eebe0e5541ee1fbae4fd5b6da9ead382fd1da15a9f94bb2a040","observation_id":"e4cba9ce-f1ce-45ad-a2f1-7fbfd8a9f1a6","resolution":{"observed_at":"2026-08-11T14:58:49.168149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.154728Z","title":"Lgm: Large multi-view gaussian model for high-resolution 3d content creation","venue":null,"work_id":"5121bd62-a433-41af-8ddf-bc7c9f58da15","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.578569Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:bd04129a4c92b8e9ac0393ebf0baca5a7f97271d0987bfbe2121780369cce6be","observation_id":"f10dfbe5-3576-479d-b608-7b5e3c19f7e5","resolution":{"observed_at":"2026-08-11T14:58:49.158294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11878","last_updated":"2024-03-18T15:31:57Z","snapshot_observed_at":"2026-08-09T03:42:37.900846Z","submitted_at":"2024-03-18T15:31:57Z","title":"InTeX: Interactive Text-to-texture Synthesis via Unified Depth-aware Inpainting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11878","snapshot_observed_at":"2026-08-11T14:58:48.581729Z","title":"Intex: Interactive text-to-texture syn- thesis via unified depth-aware inpainting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.581729Z"},"links":{"cited_paper":"/paper/2403.11878","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:fe02151702754f32486de5cdeddee8ac50eee254ea5f5dfeb77882b3bf7c181c","observation_id":"1eb99b16-c34b-4b90-ac3b-1bb3494b5c33","resolution":{"observed_at":"2026-08-11T14:58:48.581729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.144945Z","title":"Megascenes: Scene-level view synthesis at scale","venue":null,"work_id":"95426871-2fec-49cd-8966-a32725725cc7","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.585629Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:0d35c5a985ec8d99ec67866ca495aca97089b708e773ff58921e554d9a6e2c31","observation_id":"6554471f-8a6c-48e4-be37-b04ee0a0ff91","resolution":{"observed_at":"2026-08-11T14:58:49.148520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.134912Z","title":"Tracking through containers and occlud- ers in the wild","venue":null,"work_id":"c8ebb3ad-6ea7-4ee5-8014-069bf4995704","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.588952Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:106ccfaf3ecf5f291a9ab5fc646a7935b392f1f75aed0d555b46497152ab5856","observation_id":"31dc5386-0707-42a5-a91d-9c47ba3c988c","resolution":{"observed_at":"2026-08-11T14:58:49.138622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.124636Z","title":"Generative camera dolly: Ex- treme monocular dynamic novel view synthesis","venue":null,"work_id":"8db91b37-f93a-4b48-8670-9ce222fdb665","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.592356Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:abc644b5cf121150a5b5f7df4eb53fa646c0497ece3711430fe003bda5ac91cc","observation_id":"cd9fbace-c39d-46b4-9996-984d99c609b1","resolution":{"observed_at":"2026-08-11T14:58:49.128510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02201","last_updated":"2023-12-02T20:41:27Z","snapshot_observed_at":"2026-08-10T05:09:57.293983Z","submitted_at":"2023-12-02T20:41:27Z","title":"ImageDream: Image-Prompt Multi-view Diffusion for 3D Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02201","snapshot_observed_at":"2026-08-11T14:58:48.595830Z","title":"Imagedream: Image-prompt multi-view diffusion for 3d generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.595830Z"},"links":{"cited_paper":"/paper/2312.02201","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:55be87e00b1451b7024f3b1fde35b8d2f1e2c1e106c3c78aeb39f16e46e2acf8","observation_id":"93732e78-57c9-40aa-82c0-7e6fa12dd893","resolution":{"observed_at":"2026-08-11T14:58:48.595830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.114306Z","title":"Barron, Ricardo Martin- Brualla, Noah Snavely, and Thomas Funkhouser","venue":null,"work_id":"8cda1675-1337-470f-9adb-711436fc17b2","year":2021},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.599922Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:6bfccdb82a43d32bcf50c34bbd34cd4e3c90a76fa56369196b24d7b1aff23c65","observation_id":"1ee6d54c-9c73-40e7-a8b3-08a34412bfb9","resolution":{"observed_at":"2026-08-11T14:58:49.117975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.105305Z","title":"Roomtex: Textur- ing compositional indoor scenes via iterative inpainting","venue":null,"work_id":"5bd57a67-7751-40af-9e18-26baf8e21999","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.603509Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:ee01dc0a08da366cb10ab3a19fbc8c6cd1ecc3f16fd191466112394af527dac1","observation_id":"ade5204e-fd4a-40e8-8310-68c75590b803","resolution":{"observed_at":"2026-08-11T14:58:49.108215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.096471Z","title":"Dust3r: Geometric 3d vi- sion made easy","venue":null,"work_id":"87bbb67a-a6f6-45cf-b684-8bc8746c7630","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.606679Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:fbea9c539d71fc729cd9d0e9b43716e69a1b4b8bcb0e4b71684b38f3b5c4f6ac","observation_id":"32bf660f-43d3-48b0-80a5-8f7967963a71","resolution":{"observed_at":"2026-08-11T14:58:49.099439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04628","last_updated":"2022-10-06T16:59:56Z","snapshot_observed_at":"2026-07-06T14:03:05.338990Z","submitted_at":"2022-10-06T16:59:56Z","title":"Novel View Synthesis with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04628","snapshot_observed_at":"2026-08-11T14:58:48.609903Z","title":"Novel view synthesis with diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.609903Z"},"links":{"cited_paper":"/paper/2210.04628","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:a701d92862430bee323888f0342d3da51b3aab95b5f754b1cd06736e5afceca5","observation_id":"5ff3d477-a737-4177-9bfe-ac2a9fa99a59","resolution":{"observed_at":"2026-08-11T14:58:48.609903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08092","last_updated":"2023-10-12T07:38:28Z","snapshot_observed_at":"2026-08-11T16:13:39.095791Z","submitted_at":"2023-10-12T07:38:28Z","title":"Consistent123: Improve Consistency for One Image to 3D Object Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08092","snapshot_observed_at":"2026-08-11T14:58:48.613293Z","title":"Consistent123: Improve consistency for one image to 3d object synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.613293Z"},"links":{"cited_paper":"/paper/2310.08092","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:2b0aee880d131e03924d62ca8e8f6a7743a430f0dd09879a80b29282293f1a20","observation_id":"979043d8-df58-4cec-ac59-7d22f8f52298","resolution":{"observed_at":"2026-08-11T14:58:48.613293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.087795Z","title":"Con- vnext v2: Co-designing and scaling convnets with masked autoencoders","venue":null,"work_id":"62cd8ac6-bbac-4178-beaa-1935618be95c","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.616683Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:eeb1bd7ce61cb3065da87797e05105f03a08f8cd8f21fb30e2d0f5e338685f10","observation_id":"e5a304b2-d1c1-4372-a9c7-598f543c5805","resolution":{"observed_at":"2026-08-11T14:58:49.090898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.078846Z","title":"Unique3d: High-quality and efficient 3d mesh generation from a single image","venue":null,"work_id":"cd644d49-c435-4bbf-bd1c-e3455fba3bf6","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.619689Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:3d709597d914d398d0784c2d81b0b73736a5084c411a2252c3b29bc5a7d9fa20","observation_id":"30533397-6522-47a7-b7e8-12cb87a62c2d","resolution":{"observed_at":"2026-08-11T14:58:49.082145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01506","last_updated":"2025-05-30T11:13:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-02T13:58:38Z","title":"Structured 3D Latents for Scalable and Versatile 3D Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01506","snapshot_observed_at":"2026-08-11T14:58:48.622808Z","title":"Structured 3d latents for scalable and versatile 3d gen- eration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.622808Z"},"links":{"cited_paper":"/paper/2412.01506","citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:fdce3577f351a4fa832b1a086a31aa8d6ee32a5ab1ea2802d85db803e3147e62","observation_id":"cb95fd6c-f9f5-4d10-9f51-3e37d6f4b862","resolution":{"observed_at":"2026-08-11T14:58:48.622808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.069058Z","title":"Neurallift-360: Lifting an in-the-wild 2d photo to a 3d object with 360deg views","venue":null,"work_id":"09c41a72-7270-4553-a7dd-b7b4b1adf442","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.626866Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:1605167cf830c177118731b270ebfcceaf2926ffbaf9d57a983fb9fb3b2d0b57","observation_id":"9339b4ab-8dee-4140-94fc-78dfdbf4e0de","resolution":{"observed_at":"2026-08-11T14:58:49.072569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.059595Z","title":"Amodal com- pletion via progressive mixed context diffusion","venue":null,"work_id":"197b1d94-fbe7-4e53-92d0-e02d682d817b","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.630365Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:0dfe489f57fde9682824782372ebf5fc2abc7c7ee862e15f3feb041905df4c2b","observation_id":"b31d01f0-f17d-4f9a-9db6-6f29126009a3","resolution":{"observed_at":"2026-08-11T14:58:49.063096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.049482Z","title":"Consistnet: Enforcing 3d consistency for multi- view images diffusion","venue":null,"work_id":"18ee9a28-75eb-4f1a-9eb4-fae7eb1d861e","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.634026Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:d3921325f8c589d19fb2a8dd8dd9af7ec03735a2da0e95a676bd84ea9bdae795","observation_id":"77426d66-82eb-4f1d-9d0e-f48054b28651","resolution":{"observed_at":"2026-08-11T14:58:49.053306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.039589Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":"ec357649-e0e8-4ec0-a0ea-e013960a4c59","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.637476Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:c6c80de7c7e7668f46aa5773eb2ec15113152bc16463d04c323ef7ae3372a198","observation_id":"7407d7a4-ea6d-41cc-9075-c38e6892875b","resolution":{"observed_at":"2026-08-11T14:58:49.043299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.029939Z","title":"Physcene: Physically interactable 3d scene synthe- sis for embodied ai","venue":null,"work_id":"22c794dc-bbc2-48cb-9a9f-0fdf573220ed","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.641195Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:6fd21c17e73a2dd023e388ee122484cefec3170bdddb26bf02f1b4a6c4b48ee3","observation_id":"e9632b82-250d-4b8e-b99a-64eda2a6d401","resolution":{"observed_at":"2026-08-11T14:58:49.033516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.019137Z","title":"Scannet++: A high-fidelity dataset of 3d indoor scenes","venue":null,"work_id":"7e9f2f23-34da-44b0-875d-11da578f7bc1","year":2023},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.644665Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:ab9672bf034ab117fee1f4d79c7337ba73e261c592231daa59cd9b709f1410dc","observation_id":"f1518f66-0c17-4a08-bfb0-8aad199bffb0","resolution":{"observed_at":"2026-08-11T14:58:49.023150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:49.009294Z","title":"pixelnerf: Neural radiance fields from one or few images","venue":null,"work_id":"ed382297-270e-4988-9de8-cb2a3ca312d2","year":2021},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.648128Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:3cad378a69793143504c17eef31800e3e88fa5f94294414378b4ed490273f882","observation_id":"a42f2a69-7ce5-4e76-9bbe-8f2f8f7d5c44","resolution":{"observed_at":"2026-08-11T14:58:49.012955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.998850Z","title":"Amodal ground truth and completion in the wild","venue":null,"work_id":"124d49ab-5dfc-40eb-af98-472b72e49d70","year":2024},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.651357Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:54e8705e75c16073d1545578c6a81fd162e1582d849df917019a800e532290db","observation_id":"188be821-c2a2-43d6-9d64-6411a7a30c08","resolution":{"observed_at":"2026-08-11T14:58:49.002748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.987432Z","title":"Self-supervised scene de- occlusion","venue":null,"work_id":"53caece0-0f2f-43f5-88e1-64feb94fcccf","year":2020},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.655218Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:1d6a4deb2fa6870a4b034a7135745a29fab367ec66a925a6c37d7422edc59ace","observation_id":"cc2493df-8b02-4fd0-ae64-d00fd3d9613c","resolution":{"observed_at":"2026-08-11T14:58:48.991592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.976935Z","title":"Free3d: Consistent novel view synthesis without 3d representation","venue":null,"work_id":"d3136ad1-f158-4b8a-8ecd-b88bce4f91b5","year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.658439Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:87153f8231750d6138e76c0cbf2a9e3a47b70b43cb9151a1fb9cf52197993c77","observation_id":"776ce211-69ab-4880-aff9-bee3decc3deb","resolution":{"observed_at":"2026-08-11T14:58:48.980739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.966904Z","title":"Stereo magnification: Learning view syn- thesis using multiplane images","venue":null,"work_id":"38b22ad8-81fe-4a8e-b711-c560ae0cee09","year":2018},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.661667Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:25229197d6e987817ea0c7161359cee8aab28c8662c3db1e3ced36e29dae12d7","observation_id":"35406f09-c3e8-47cc-a8e5-09683bf59bf1","resolution":{"observed_at":"2026-08-11T14:58:48.970571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.957021Z","title":"norm patchtokens","venue":null,"work_id":"ecafbbb8-24bc-4e08-bcf8-042db4fd3df8","year":2017},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.665187Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:41bc454890814fb3e21e94c1c868cb1abf4b9ae5689da566a39c7c9022363b4f","observation_id":"78360498-42cb-4dca-99d4-b8d3f040e20e","resolution":{"observed_at":"2026-08-11T14:58:48.960185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:58:48.947598Z","title":"FXRvdpBKje59HAj3tIVdwRQpPk0=","venue":null,"work_id":"3573dfc8-99ee-406d-a9ee-d9b269710639","year":null},"citing_paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-11T14:58:48.669334Z"},"links":{"citing_paper":"/paper/2412.11457"},"observation_digest":"sha256:4f353ef2746266866e1272488d0bd5dab82fe6bc8403d54e324475e29ebf1fc8","observation_id":"a4f13b81-4ad0-421e-99bd-8ec2b0f5f62c","resolution":{"observed_at":"2026-08-11T14:58:48.950713Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.11457","last_updated":"2025-03-22T12:34:37Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T16:14:54.561342Z","submitted_at":"2024-12-16T05:23:45Z","title":"MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":0,"verified_fuzzy":52},"total_outbound_references":103},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 100 of 103 outbound references and 0 inbound Pith citation observations for arXiv:2412.11457."}