{"as_of":"2026-08-07T19:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1087b137cacfaacef679c14c1378e5f473865bd5baa4cea22567e3365e89ed9c","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:45:45.014848Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T09:45:40.424131Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07410","snapshot_observed_at":"2026-08-01T09:45:40.424131Z","title":"arXiv preprint arXiv:2507.07410 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20660","last_updated":"2026-07-22T18:38:20Z","snapshot_observed_at":"2026-08-06T14:13:50.227938Z","submitted_at":"2026-07-22T18:38:20Z","title":"Axolotl3D: a Unified Framework for Faithful 3D Shape Completion","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T09:45:40.424131Z"},"links":{"cited_paper":"/paper/2507.07410","citing_paper":"/paper/2607.20660"},"observation_digest":"sha256:cde301e121bcbc2db52fcf67af4377ca08a0d70ae19d92a9c874d6280c7286f6","observation_id":"38d9f368-78df-4ff9-839e-9bb281f875f2","resolution":{"observed_at":"2026-08-01T09:45:40.424131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.07410/citation-record","integrity":"/paper/2507.07410/integrity","json":"/paper/2507.07410/citation-record.json","paper":"/paper/2507.07410"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.876742Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":"78d35cf4-cf3a-4d7f-bf01-1560e9e3a9aa","year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.737640Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:0d49d2522d20886a190398ae9f0da0f00feb2f6893cc3e54804db3da7aef7987","observation_id":"5982a2d7-50eb-4d66-9d12-0cf6949dfa4d","resolution":{"observed_at":"2026-08-06T18:45:45.880363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.865484Z","title":"pixelsplat: 3d gaussian splats from image pairs for scalable generalizable 3d reconstruction","venue":null,"work_id":"33c3f851-51b8-43c6-8789-f0441ee5fe8d","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.741950Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:5bedcbf5fe8dfe95a3102d35074b39712f990207d67f02df34dd8907782966d6","observation_id":"251c4f17-0142-4acc-9c35-a9a45339c8be","resolution":{"observed_at":"2026-08-06T18:45:45.869350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.853628Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":"5eb2c677-e850-4834-bd94-b1aabf664356","year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.745291Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:51804ee34ecc7e1e0bc83617e68427a065959dbb6e7ad2551f8e9f6533f8c156","observation_id":"62c2b497-f1d0-49c4-9848-cdf56d1bcd24","resolution":{"observed_at":"2026-08-06T18:45:45.857619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03421","last_updated":"2025-03-31T13:42:34Z","snapshot_observed_at":"2026-08-04T16:03:17.207881Z","submitted_at":"2024-04-04T12:58:46Z","title":"Gen3DSR: Generalizable 3D Scene Reconstruction via Divide and Conquer from a Single View","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03421","snapshot_observed_at":"2026-08-06T18:45:44.748589Z","title":"General- izable 3d scene reconstruction via divide and conquer from a single view","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.748589Z"},"links":{"cited_paper":"/paper/2404.03421","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:3cf9d0a650db33865908d9c1e4128c03758ed27e19bfde0ffb46a6d8ab70b076","observation_id":"5833b1a2-399c-4f07-bda2-afeed8348df6","resolution":{"observed_at":"2026-08-06T18:45:44.748589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.842921Z","title":"Google scanned objects: A high- quality dataset of 3d scanned household items","venue":null,"work_id":"8b16bb56-9fc1-4d28-baf2-0e314c644852","year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.753526Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:003284d1b94ffea4ddd31e359112aa7480537ab0b71e9ce0a7f21fabc431169c","observation_id":"e3f1d415-0126-48e2-82fa-f13d523de10b","resolution":{"observed_at":"2026-08-06T18:45:45.846383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-06T18:45:44.758445Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.758445Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:e69314462d709b8cf8d18f4a5a67963b029c505cb103e4b568c3ba3a4063c796","observation_id":"bd805cc5-1ac4-4910-ac5d-10bdbab896af","resolution":{"observed_at":"2026-08-06T18:45:44.758445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.831023Z","title":"Instruct-nerf2nerf: Edit- ing 3d scenes with instructions","venue":null,"work_id":"da23d030-5d4e-4849-b1bd-c4fbaf555697","year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.762441Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:bdec9e1b73308c291f6e27aff3a19a73957d2fd0a5b16b2051efc2ac9cc51e8c","observation_id":"afd1f6aa-543e-44eb-89f0-feb1814c5b0d","resolution":{"observed_at":"2026-08-06T18:45:45.835340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.765751Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.765751Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:facdc4da93aa65fb9d1d40cfe43eb663ec648c30de649985659a2e377c4adb81","observation_id":"8a8d7fc6-fc16-44fe-804f-0db7d82f1b5b","resolution":{"observed_at":"2026-08-06T18:45:44.765751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.769404Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.769404Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:c539562995c5a627c59e8282a9a12308bcb6cde942ee6791ae5995dbd3de731d","observation_id":"6d4905c8-8c3c-4565-90e1-475d8ec35814","resolution":{"observed_at":"2026-08-06T18:45:44.769404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-06T18:45:44.772359Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.772359Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:6e2b9236f794110c02fd40d4d73a62287862279ed86cd97ff3075c222b5ea180","observation_id":"2b2d8f3f-13b2-4cb9-a797-4724f5d69e0c","resolution":{"observed_at":"2026-08-06T18:45:44.772359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.802463Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":"4dcfc726-54ac-4a21-8e1d-db4fa462ce07","year":2020},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.776119Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:94a0d91e28dc4f95a07dbb61bac1c75db57baaa55cb28dd998efe79b25e0b4cb","observation_id":"00b41334-84db-47a9-9780-2470e0e1a713","resolution":{"observed_at":"2026-08-06T18:45:45.806326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04400","last_updated":"2024-03-09T10:47:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-08T00:03:52Z","title":"LRM: Large Reconstruction Model for Single Image to 3D","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04400","snapshot_observed_at":"2026-08-06T18:45:44.780179Z","title":"Lrm: Large reconstruction model for single image to 3d","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.780179Z"},"links":{"cited_paper":"/paper/2311.04400","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:1cedf1f8b4f0fe0f7c9a5af301141ae6ccb27b8b98526b019cd528cd19744e4d","observation_id":"1c15f1fc-5998-4d31-bdec-dda7904d6f63","resolution":{"observed_at":"2026-08-06T18:45:44.780179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.789773Z","title":"Epidiff: Enhancing multi-view synthesis via localized epipolar-constrained diffusion","venue":null,"work_id":"966d8909-bff5-412d-b2fc-771cd9d2682e","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.784055Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:2bf0611614d68eb0ac0c81e771db4c36c1b203a208e713cb6acaf48f857c1306","observation_id":"833cfe3b-7b53-4389-b54c-846072044da6","resolution":{"observed_at":"2026-08-06T18:45:45.793939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.778300Z","title":"Shapo: Im- plicit representations for multi-object shape appearance and pose optimization","venue":null,"work_id":"e2861268-8fa0-4d57-9ce2-b6d7131345b0","year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.787516Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:7dcf9d71725c01c0fe4ddae6a7ad15135154589872c97b9696b501e3c720b640","observation_id":"82a2841e-a228-4a39-8379-714411c8a512","resolution":{"observed_at":"2026-08-06T18:45:45.782398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.767323Z","title":"Neo 360: Neural fields for sparse view synthesis of outdoor scenes","venue":null,"work_id":"4bc3a0d8-85e6-42ce-8dde-bf8e0cd65ebb","year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.792347Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:518193104ad3a2c8339d05d8cf07371aa2cc43c609254f7071f8f9f6d7bfe7cf","observation_id":"db567bd0-3909-4b67-ae03-d408bce8c8d9","resolution":{"observed_at":"2026-08-06T18:45:45.770944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20220","last_updated":"2024-10-26T16:26:41Z","snapshot_observed_at":"2026-07-06T19:40:12.973874Z","submitted_at":"2024-10-26T16:26:41Z","title":"Neural Fields in Robotics: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20220","snapshot_observed_at":"2026-08-06T18:45:44.796004Z","title":"Neural fields in robotics: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.796004Z"},"links":{"cited_paper":"/paper/2410.20220","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:7643e9aa8c54a40cfef5c38b147d3cbd3f6abadd90d5b1bb593ce3bf2f92044e","observation_id":"93f25457-0a35-4dff-ae5c-89ff509e9546","resolution":{"observed_at":"2026-08-06T18:45:44.796004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.753698Z","title":"Nerf-mae: Masked autoencoders for self-supervised 3d representation learning for neural radiance fields","venue":null,"work_id":"4880f4b3-7519-45d7-b657-9472ad1d18ed","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.799875Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:ba8c9939e894aa2e33d7d0d2411978d89f43d9624cc529ed9ca1fc93041b0330","observation_id":"f650789f-9d06-4726-b1c9-365fa68b5c15","resolution":{"observed_at":"2026-08-06T18:45:45.759049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.737095Z","title":"Spad: Spatially aware multi-view diffusers","venue":null,"work_id":"43109d15-5930-4c6a-b466-93fc8e53d9d1","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.804322Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:abe92dc974192c5ce43ee5476fcf27869c8789d390e7a9b9991adc3a3fe18ccc","observation_id":"4cfdf420-16ee-4556-976d-f52909d1b4c6","resolution":{"observed_at":"2026-08-06T18:45:45.742694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.808504Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.808504Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:07c184bd9156e4284dd9f7a6400be15ad66d475aa486596e93e93766e72ea695","observation_id":"e52055cf-ab51-47cd-89ba-a9b0e6d0047d","resolution":{"observed_at":"2026-08-06T18:45:44.808504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.812264Z","title":"Lerf: Language embedded radiance fields","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.812264Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:8130890ffebdfd80be2e7591b3111bd09070e7beb6c609655e25d675d03f4c28","observation_id":"67dd98b3-d29d-41a6-ae8e-465b5006deec","resolution":{"observed_at":"2026-08-06T18:45:44.812264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-06T18:45:44.816138Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.816138Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:1e290dc2647aa56302b154639aebd2a8db49e8dd5af45d362ca6ece18051c318","observation_id":"c96bbdc2-1997-40f0-a032-31a4b97db436","resolution":{"observed_at":"2026-08-06T18:45:44.816138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.819708Z","title":"Segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.819708Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:bf7e65ab24e0ed67c0b9af6c10c61a1509c2cb9991da23c3157a073eca8bd513","observation_id":"d3d6551b-20d8-420d-850c-0e3331a5da5a","resolution":{"observed_at":"2026-08-06T18:45:44.819708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.697297Z","title":"Eschernet: A genera- tive model for scalable view synthesis","venue":null,"work_id":"69a7c29e-d7a6-4ee8-afa3-35bbc04cefc4","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.823315Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:2dcb373bc5d893d28432b5eba525be3d0e065e3052eb7733fcea0b7e91fe84ee","observation_id":"4e328ef1-4a99-4bf6-bcc5-d1e90dab544b","resolution":{"observed_at":"2026-08-06T18:45:45.702308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.682613Z","title":"Neroic: Neural rendering of objects from online image collections","venue":null,"work_id":"592a7f40-57bc-41a0-8100-3716202eb83f","year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.826638Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:ff075fbbf50d4b23edb6340cebd52eabbb84ffeae005f73956a6d5c4bfd3ab8d","observation_id":"a71bf3f6-2aba-4c0c-9754-f84e19bdfe48","resolution":{"observed_at":"2026-08-06T18:45:45.686889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.670974Z","title":"Neural scene flow fields for space-time view synthesis of dy- namic scenes","venue":null,"work_id":"53bb92ca-05ab-4d1f-9904-7bf9b638b1e0","year":2021},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.829825Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:9aabe9aae6860a62355cd3c06401181733339cb75e2e37d6befeea134b4a51e0","observation_id":"bb38538c-5f32-4949-a2eb-2893f4c97d0b","resolution":{"observed_at":"2026-08-06T18:45:45.674817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.658756Z","title":"Neuralangelo: High-fidelity neural surface reconstruction","venue":null,"work_id":"941a6417-d315-4c48-99cf-f3c625f762df","year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.834161Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:a34956448d4c29b7ae93d6c8569c68b21f73b0b1090464a2f38bd929429436e5","observation_id":"d9231480-b492-4ffa-b2b0-a638f30453c9","resolution":{"observed_at":"2026-08-06T18:45:45.662905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.642770Z","title":"One-2-3-45++: Fast single im- age to 3d objects with consistent multi-view generation and 3d diffusion","venue":null,"work_id":"928d21b4-edaf-4527-9e81-f31d1c1d2a43","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.837981Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:988f00950b210a8ab378c59e7d921a088b6cf7967c445b6401fe922565f091a8","observation_id":"6a001eaa-48cf-4d1b-8530-c264a87694da","resolution":{"observed_at":"2026-08-06T18:45:45.646892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.628392Z","title":"Zero-1-to- 3: Zero-shot one image to 3d object","venue":null,"work_id":"a9ef8b6c-ad35-4d5e-85d1-79de280d696f","year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.841875Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:43406a0fa5a78ba376a2c58d98fd24dcaee4bfe63acd31fa9b9d2d61f4392aad","observation_id":"f812f917-c32c-42c3-84de-6e801b59e50a","resolution":{"observed_at":"2026-08-06T18:45:45.634208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03453","last_updated":"2024-04-15T10:28:44Z","snapshot_observed_at":"2026-07-06T16:15:31.848927Z","submitted_at":"2023-09-07T02:28:04Z","title":"SyncDreamer: Generating Multiview-consistent Images from a Single-view Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03453","snapshot_observed_at":"2026-08-06T18:45:44.845971Z","title":"Syncdreamer: Gen- erating multiview-consistent images from a single-view im- age","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.845971Z"},"links":{"cited_paper":"/paper/2309.03453","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:1f6a39a02ffbb497e7c0f6ec43be88e4674d8cf04cefcbe3702deb3e61859222","observation_id":"fd345102-e6c0-475f-82d6-c445ff0d7995","resolution":{"observed_at":"2026-08-06T18:45:44.845971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.615830Z","title":"Wonder3d: Sin- gle image to 3d using cross-domain diffusion","venue":null,"work_id":"01d09f0e-36d6-43e5-bc1c-1f5b747652bd","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.850770Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:503bc768b966d90218193923ac4273c31d724112773946672c4069a7de7211a2","observation_id":"d4a22a02-1016-4794-8d89-1565be2503a5","resolution":{"observed_at":"2026-08-06T18:45:45.620022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.601815Z","title":"Fsd: Fast self-supervised single rgb-d to categorical 3d objects","venue":null,"work_id":"dc2824ea-dfe8-473e-a53a-b2d340838180","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.854045Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:30ef13ef3a79f67a749be26df32c7ba4b1499389fc7dc3bc251a0d8e9c24f53e","observation_id":"b29dbe4f-086a-455e-a4d0-96f5d7205d8f","resolution":{"observed_at":"2026-08-06T18:45:45.606078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.584488Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis","venue":null,"work_id":"ad3d2819-6eb9-407e-b568-83861edfc247","year":2021},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.857962Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:092eee40e87f21da9897f8d16fd0b7717f1aebadcc4c45e5f17fd5d1f9fb4837","observation_id":"9af950d9-c2c7-4f7f-a2b7-8b9f7206b8a3","resolution":{"observed_at":"2026-08-06T18:45:45.588696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.572026Z","title":"Instant neural graphics primitives with a mul- tiresolution hash encoding","venue":null,"work_id":"66fbf808-cd6c-4913-b4d4-d3134d07e0d0","year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.861044Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:b1b3c314bba390052209a8f1469ad753569a50841c8d3c39cc736e8e1fabecef","observation_id":"afe0c98b-cdf6-45c2-bc73-933abece65af","resolution":{"observed_at":"2026-08-06T18:45:45.576720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11141","last_updated":"2024-02-17T00:15:09Z","snapshot_observed_at":"2026-08-05T23:08:32.859583Z","submitted_at":"2024-02-17T00:15:09Z","title":"Semantically-aware Neural Radiance Fields for Visual Scene Understanding: A Comprehensive Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11141","snapshot_observed_at":"2026-08-06T18:45:44.864862Z","title":"Semantically-aware neural radiance fields for visual scene understanding: A comprehensive review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.864862Z"},"links":{"cited_paper":"/paper/2402.11141","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:8c4a67c1e2ba59b0ab903dac2c784711c897cd0e5041ada12c5a4be6bc3a858a","observation_id":"e7d79a86-3908-4ea0-94e9-574a519eddce","resolution":{"observed_at":"2026-08-06T18:45:44.864862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.561369Z","title":"pix2gestalt: Amodal segmentation by synthesizing wholes","venue":null,"work_id":"72d6e041-ee9d-4dbd-96ca-aa0fe1de638d","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.868863Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:3d30b0d527ab6889bfb6e608e9f62d80bba21aee19a96c45af282f30e30865ab","observation_id":"3dd0c2b9-5bfd-482f-9606-7a3d07f2687a","resolution":{"observed_at":"2026-08-06T18:45:45.565029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.873377Z","title":"Masked autoencoders for point cloud self-supervised learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.873377Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:e6a89dceef144d4f907f95a044d942112f13d922ee9e9a81e2dc86411f140ddb","observation_id":"2a852ab7-8347-4aba-85b9-1d0b994b6c3f","resolution":{"observed_at":"2026-08-06T18:45:44.873377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-06T18:45:44.878163Z","title":"Dreamfusion: Text-to-3d using 2d diffusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.878163Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:84cad1e4f9891a7b3a61f7ad6338cb7050e98d33c0c7b355aa612638c1df5ca9","observation_id":"98ded6ef-c107-48ea-8f31-1590c19c6850","resolution":{"observed_at":"2026-08-06T18:45:44.878163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.543678Z","title":"High quality entity segmentation","venue":null,"work_id":"d3fa4896-d1d0-43a4-84b7-8d6502b87575","year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.882836Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:c737b55356211702c99a36fce767299b587d3b93e0baf9dee889def105a8c2fc","observation_id":"8654b8cb-05e6-4e3b-92c3-861fe583182e","resolution":{"observed_at":"2026-08-06T18:45:45.547052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.888250Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.888250Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:0c8bc31d0fb2d8095fa624bb83dd9861ab1b37f87e5a2c867c42901a63ef4e82","observation_id":"6c5a1b06-66a8-406a-b8ef-b5091c8608c7","resolution":{"observed_at":"2026-08-06T18:45:44.888250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.894502Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.894502Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:82f4a8215d4233d770008a4f5f316d5b3716399d69654b18bfb7687714b957b0","observation_id":"abe0020b-8a7a-45d3-a7d5-839b143c7f5e","resolution":{"observed_at":"2026-08-06T18:45:44.894502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.518343Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":"7c60d48e-993e-481d-abed-45a1c7efaa0c","year":2015},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.900196Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:160451136c584675acc031151c1fc4cea2aec90b8a80c4c4c98cd8e866562377","observation_id":"938708e6-7c09-405a-aa1e-2440ade91de3","resolution":{"observed_at":"2026-08-06T18:45:45.521847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15110","last_updated":"2023-10-23T17:18:59Z","snapshot_observed_at":"2026-07-06T16:37:19.963994Z","submitted_at":"2023-10-23T17:18:59Z","title":"Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15110","snapshot_observed_at":"2026-08-06T18:45:44.904032Z","title":"Zero123++: a single image to consistent multi-view dif- fusion base model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.904032Z"},"links":{"cited_paper":"/paper/2310.15110","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:424d6715a291de5953c0431e06e849e675b7a0fa7598a07c02db0a74d6ef1422","observation_id":"ada14fd0-6eef-412e-967b-d889f881a030","resolution":{"observed_at":"2026-08-06T18:45:44.904032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.907826Z","title":"Panoptic lifting for 3d scene understanding with neural fields","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.907826Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:eaba79659a5f4dec4f9b1f66bfd4ed7cffbce9f58efc22ffbba41ade250d16de","observation_id":"37d7c1b1-8c43-4921-9a86-d3e5e36c3b99","resolution":{"observed_at":"2026-08-06T18:45:44.907826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-06T18:45:44.911772Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.911772Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:054e54c8951170f1aede316a200164475c5565935c1bd04a54205e61f317d47b","observation_id":"af9a080c-97d3-4468-945b-4612c455d68e","resolution":{"observed_at":"2026-08-06T18:45:44.911772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16653","last_updated":"2024-03-29T08:39:23Z","snapshot_observed_at":"2026-07-06T16:25:05.493379Z","submitted_at":"2023-09-28T17:55:05Z","title":"DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16653","snapshot_observed_at":"2026-08-06T18:45:44.915857Z","title":"Dreamgaussian: Generative gaussian splatting for effi- cient 3d content creation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.915857Z"},"links":{"cited_paper":"/paper/2309.16653","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:1b0505dc7b4ae05e86090002edd4263debda0b52736d39ba9bd5836b5f53de66","observation_id":"9b34c774-7456-430c-b5be-3a1daa7f6693","resolution":{"observed_at":"2026-08-06T18:45:44.915857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.499610Z","title":"Lgm: Large multi-view gaussian model for high-resolution 3d content creation","venue":null,"work_id":"0a7f3b0d-b6df-4044-bb5d-836cd2b2b506","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.919781Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:19f899af910d2a3f327882b1a37bf35ef0b51803afa08a1e59978265ec7719f5","observation_id":"bbf2dc5f-3729-4811-b0a4-d437cb1f9e65","resolution":{"observed_at":"2026-08-06T18:45:45.503480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.487940Z","title":"Mvdiffusion++: A dense high- resolution multi-view diffusion model for single or sparse- view 3d object reconstruction","venue":null,"work_id":"79f32695-0c8d-4ee5-a161-dc9f12d4fa63","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.923867Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:dee2079dd96db6c56a4a178cfd0014cde41b9798314a2f2778276061e95ee5d6","observation_id":"f2aad46d-6310-41f1-9dfe-467d5107b53b","resolution":{"observed_at":"2026-08-06T18:45:45.491921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.07058","last_updated":"2022-10-25T01:44:56Z","snapshot_observed_at":"2026-07-06T13:09:58.872534Z","submitted_at":"2022-05-14T13:15:32Z","title":"RTMV: A Ray-Traced Multi-View Synthetic Dataset for Novel View Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.07058","snapshot_observed_at":"2026-08-06T18:45:44.927814Z","title":"Rtmv: A ray-traced multi-view synthetic dataset for novel view syn- thesis","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.927814Z"},"links":{"cited_paper":"/paper/2205.07058","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:074c9df65604443ab941685ece574e48e0796b01acb45510b53993bc6476fd28","observation_id":"4fff3516-0062-4a2d-95af-bb5265be1a40","resolution":{"observed_at":"2026-08-06T18:45:44.927814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.931753Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.931753Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:1cd7b0f19684896ff1d6905223c4bf292d6544ec1f2b2cb7362d6ddb9cce36fb","observation_id":"72ff3a3b-caf5-4789-b125-300cc5be23c0","resolution":{"observed_at":"2026-08-06T18:45:44.931753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.469950Z","title":"Mcvd-masked conditional video diffusion for prediction, generation, and interpolation","venue":null,"work_id":"12412c9c-de42-4c4d-8aad-2c303cb7bb01","year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.935722Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:41fa4400cbc8b8bf48f59d3c05a2c32f2409ee1a1f776a97c7a0c01c59332ca9","observation_id":"c9e7b1c9-d5bc-48de-98dd-2bc5fa29e6c8","resolution":{"observed_at":"2026-08-06T18:45:45.473380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.459551Z","title":"Sv3d: Novel multi-view syn- thesis and 3d generation from a single image using latent video diffusion","venue":null,"work_id":"d1d84ee6-e366-4337-9a24-a9ae424773f6","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.939215Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:a513dd671d79c7d8638bbe8e2941fafbaa75ff95fe5d6407f60d2d392b93c5c3","observation_id":"73ab1b2f-32e1-4e7c-864a-25b472e83d2a","resolution":{"observed_at":"2026-08-06T18:45:45.463218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02201","last_updated":"2023-12-02T20:41:27Z","snapshot_observed_at":"2026-08-04T13:49:28.484746Z","submitted_at":"2023-12-02T20:41:27Z","title":"ImageDream: Image-Prompt Multi-view Diffusion for 3D Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02201","snapshot_observed_at":"2026-08-06T18:45:44.943140Z","title":"Imagedream: Image-prompt multi-view diffusion for 3d generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.943140Z"},"links":{"cited_paper":"/paper/2312.02201","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:850d68ee0ff434e8dd94474c226c6a64ee4a31219251f7329af667845fb419b1","observation_id":"eed6d10b-6271-4c23-b0aa-a7bac91a0191","resolution":{"observed_at":"2026-08-06T18:45:44.943140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.10689","last_updated":"2023-02-01T06:00:21Z","snapshot_observed_at":"2026-08-02T09:26:48.635481Z","submitted_at":"2021-06-20T12:59:42Z","title":"NeuS: Learning Neural Implicit Surfaces by Volume Rendering for Multi-view Reconstruction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.10689","snapshot_observed_at":"2026-08-06T18:45:44.947561Z","title":"Neus: Learning neural implicit surfaces by volume rendering for multi-view reconstruction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.947561Z"},"links":{"cited_paper":"/paper/2106.10689","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:88a157b22e7140208a1af808763a20c865fa20968893da7f1afaff532c5d8af6","observation_id":"8175b070-ece9-4495-b824-1f73bb13b4bb","resolution":{"observed_at":"2026-08-06T18:45:44.947561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.951642Z","title":"Image quality assessment: from error visibility to structural similarity","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.951642Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:507c0825e1ad440565537811f6977452b92dc178f86a15477db388cf6bedb865","observation_id":"22a40b51-9083-41cd-8ce5-8960847ef905","resolution":{"observed_at":"2026-08-06T18:45:44.951642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.442448Z","title":"Con- vnext v2: Co-designing and scaling convnets with masked autoencoders","venue":null,"work_id":"aafd47b0-5b87-4b61-90b5-5d64121a8975","year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.955348Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:95dea0261e0f8344be970df84b4abc885f59e49e839acf4bdf9450cfd2acc2e1","observation_id":"5c12b858-6aa0-4c1c-97fe-f8a337bff54f","resolution":{"observed_at":"2026-08-06T18:45:45.446215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.959464Z","title":"4d gaussian splatting for real-time dynamic scene rendering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.959464Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:60003b682137b58d836c418d899f82d1a65472d37d292419ca780c91d052a5f7","observation_id":"24b3c0c6-9dde-4b24-a635-f0800ad67cc4","resolution":{"observed_at":"2026-08-06T18:45:44.959464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.423359Z","title":"Sparp: Fast 3d object reconstruction and pose estimation from sparse views","venue":null,"work_id":"06dfb088-f652-49ab-8860-231f9b80fbbd","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.962926Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:2d565804d3222f221e78f7b4c95b5c6a0ec1a71ce9ebc600dff239391b04e27d","observation_id":"4ebddc3f-aeeb-4fa2-a9bf-c02aa0c60603","resolution":{"observed_at":"2026-08-06T18:45:45.427205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07191","last_updated":"2024-04-14T16:54:24Z","snapshot_observed_at":"2026-07-06T17:58:25.894552Z","submitted_at":"2024-04-10T17:48:37Z","title":"InstantMesh: Efficient 3D Mesh Generation from a Single Image with Sparse-view Large Reconstruction Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07191","snapshot_observed_at":"2026-08-06T18:45:44.966614Z","title":"Instantmesh: Efficient 3d mesh generation from a single image with sparse-view large reconstruction models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.966614Z"},"links":{"cited_paper":"/paper/2404.07191","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:5e9f215a5f04c7462e0f9f8b6f0d4289c66eddf3dff12663b43d2e31ae55d61b","observation_id":"3ab908a6-6dfe-4d97-bdd2-1ed91582cff5","resolution":{"observed_at":"2026-08-06T18:45:44.966614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.411418Z","title":"Amodal com- pletion via progressive mixed context diffusion","venue":null,"work_id":"2ea33347-4031-4a91-876d-51a5fce55083","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.970975Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:b3998cfa12aa91450452e7f1e17464ee4dee22078bd4c5e6e82e985d3339d1c7","observation_id":"86367e6b-c854-41a0-927c-dee5570be828","resolution":{"observed_at":"2026-08-06T18:45:45.415839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.974579Z","title":"Gaussian grouping: Segment and edit anything in 3d scenes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.974579Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:31cf987e87584f887056fafefda5ae0fe3439bb915820b87d6c982c93b5a2ad3","observation_id":"8268d52d-21be-4fcd-8570-f287141e4b04","resolution":{"observed_at":"2026-08-06T18:45:44.974579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.391168Z","title":"pixelnerf: Neural radiance fields from one or few images","venue":null,"work_id":"6704de23-012c-44cf-93bb-b4d3f249c0a7","year":2021},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.980208Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:1a62944ad8b2deb5cefbd68d21d0a551d8ba3393567006d12a231a7037caa9ad","observation_id":"c775f8ad-63d6-45fa-a6b3-5b26dfc9ac30","resolution":{"observed_at":"2026-08-06T18:45:45.394951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.379685Z","title":"Ir- shad, and Ken Goldberg","venue":null,"work_id":"870c1da5-e4ef-4501-b7ad-160e5a6c56a6","year":2025},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.983922Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:3ce5cc528dd93b4fde4504f5f09801c9e2bc2db2832b48e72c5564bd4cdd63d8","observation_id":"fb4d9298-c708-4332-b2b1-29dcf45603cf","resolution":{"observed_at":"2026-08-06T18:45:45.383955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.367761Z","title":"Amodal ground truth and completion in the wild","venue":null,"work_id":"80a8421b-b951-4dd0-a3f5-999470cfeac7","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.987149Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:cf3c3e3eaa341f80f475fd8d7a88f867b5a51e7d3cd39ee7b3e0140bae80a4d5","observation_id":"1cd85960-db66-4aec-9d79-ce9614e45baa","resolution":{"observed_at":"2026-08-06T18:45:45.371902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.990524Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.990524Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:b95ab01a8c2787c4a6584679b274b5cb45e38bfc7505f38c4e6cb7e4c6b512e9","observation_id":"ead789d9-8ae6-47be-a171-443a2e919b3f","resolution":{"observed_at":"2026-08-06T18:45:44.990524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.347072Z","title":"Free3d: Consistent novel view synthesis without 3d representation","venue":null,"work_id":"f45a38c2-acd5-4b19-ad94-373a4d05d102","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.995249Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:7313b271aba2946553c688929f1b60a647719f54bf63667fc0f12ba2dd7a8f40","observation_id":"f702ce00-c23b-41ed-abb3-fa27639a2f9c","resolution":{"observed_at":"2026-08-06T18:45:45.350943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.333899Z","title":"3d gaussian splatting in robotics: A survey,","venue":null,"work_id":"77cca4d9-e6fd-4079-8538-427e8a967d07","year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.999214Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:b6fbb19118011224239a588049c900e5a809f31cfe3ed6f46ae179746fd43497","observation_id":"54db729b-4b16-4ab0-aa15-dd9b275976c0","resolution":{"observed_at":"2026-08-06T18:45:45.338403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.320714Z","title":"Triplane meets gaussian splatting: Fast and generalizable single-view 3d reconstruction with transformers","venue":null,"work_id":"7866f586-a858-4c81-a94e-1a64a01420f5","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:45.006370Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:47ebaf7b98b492a8df81da4bf1ff38a7a50212eb91277be75e1cf55cc41ba03e","observation_id":"f24ac62f-0ceb-474f-b12d-b18daf2f33e7","resolution":{"observed_at":"2026-08-06T18:45:45.325447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.306956Z","title":"Zero123++ is designed to generate 6 fixed views of an object with rel- ative azimuth rotations and absolute elevations","venue":null,"work_id":"5ba8c998-78f7-4120-8993-ec1a3c145c90","year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:45.010512Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:1579763de6b1abf0110187be4b50848f3ca25c38412074f3d1de99efcc356b01","observation_id":"f6e33139-fcaf-4152-b811-642e7e7c4e08","resolution":{"observed_at":"2026-08-06T18:45:45.311600Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.287486Z","title":"This is evident in the first two rows of Fig","venue":null,"work_id":"38f321bb-ebe7-4e3e-92f3-f36239a24576","year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:45.014848Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:588bb4d705ef811c065072e1a905fe519fe190d29a272dc0021f27f06a6428ba","observation_id":"527fd9bf-48aa-4d34-97ef-683480633c7b","resolution":{"observed_at":"2026-08-06T18:45:45.294587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T18:39:28.920340Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":38},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 1 inbound Pith citation observation for arXiv:2507.07410."}