{"as_of":"2026-08-24T04:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:558623e8854aa2874f8a481e0ebc095b701ef44a2cae6a3a084997ede3d8ea43","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:39:48.301572Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.09838/citation-record","integrity":"/paper/2501.09838/integrity","json":"/paper/2501.09838/citation-record.json","paper":"/paper/2501.09838"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.712145Z","title":"Raysar- 3d sar simulator: Now open source","venue":null,"work_id":"9a37bbde-7c5d-408c-9796-11fa3af40f37","year":2016},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.129114Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:1cd90f007f223d4fec89e3e46d5b1fcf0afd5bb57ca644c8ca3da64b0def2f97","observation_id":"794aafcc-f5a9-439c-b993-f36a468d1fa4","resolution":{"observed_at":"2026-08-10T19:39:48.715785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.133135Z","title":"Mip-nerf: A multiscale representation for anti-aliasing neu- ral radiance fields","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.133135Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:03be312e3b7ec5cd96c56a3596e636fcc381b0399f44488f8b62d6ba284aed1c","observation_id":"fab8a9d8-0e86-4033-8e0a-69ebfa7b531d","resolution":{"observed_at":"2026-08-10T19:39:48.133135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.136897Z","title":"Zip-nerf: Anti-aliased grid-based neural radiance fields","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.136897Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:587f2ff9f535ed619f3a940cdcca25e4a595a83338c35492d57b64f597a480fa","observation_id":"9dd515c5-72c6-4000-9563-e86f38aa4ec4","resolution":{"observed_at":"2026-08-10T19:39:48.136897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.690003Z","title":"Sf3d: Stable fast 3d mesh reconstruction with uv-unwrapping and illumination disentanglement","venue":null,"work_id":"da7e33bb-6758-445c-9406-e0ff6edd1b0c","year":2024},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.140650Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:24437c9e714fec76b1ecd4d1af3d62a620fc635284b4aef92ec11c02056536be","observation_id":"9967e4ca-7d63-4ca9-b650-fa26e1bd33b4","resolution":{"observed_at":"2026-08-10T19:39:48.693907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.144582Z","title":"Efficient geometry-aware 3d generative adversarial networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.144582Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:bc44ea7801d517c96f19412a88b659189005162306b6feb72b1003b2c553d831","observation_id":"e00edd8e-f6fd-49e9-8252-4dd8015a4542","resolution":{"observed_at":"2026-08-10T19:39:48.144582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.673602Z","title":"Generative novel view synthesis with 3d-aware diffusion models","venue":null,"work_id":"fe80a16c-df49-43dd-ae6e-69219bdc594c","year":2023},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.148757Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:51755875f745ccc31b8b33e6c51327ff58c5b5beff57109f9d616ebbdf5ea699","observation_id":"8c988b66-e426-44fb-b2aa-d38da026f762","resolution":{"observed_at":"2026-08-10T19:39:48.677338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03012","last_updated":"2015-12-09T19:42:48Z","snapshot_observed_at":"2026-08-15T22:26:43.274625Z","submitted_at":"2015-12-09T19:42:48Z","title":"ShapeNet: An Information-Rich 3D Model Repository","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.03012","snapshot_observed_at":"2026-08-10T19:39:48.152959Z","title":"Shapenet: An information-rich 3d model repository","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.152959Z"},"links":{"cited_paper":"/paper/1512.03012","citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:f0ddba2b78beb91d872530200eb3be45e8d2388851112b2ea9b9543dd9ffb3fb","observation_id":"b776f42b-f344-4047-b791-435b22bb7cdd","resolution":{"observed_at":"2026-08-10T19:39:48.152959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.157507Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.157507Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:e3876c1ff066f44ba4ba4a1d1437679f7ed61162518bdcf1b3f87edfca7f1b43","observation_id":"03cc075f-a41c-4cd7-ad3f-83da9035e9d1","resolution":{"observed_at":"2026-08-10T19:39:48.157507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.161908Z","title":"Encoder-decoder with atrous separable convolution for semantic image segmentation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.161908Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:1bda54d913c3fcf5153d47e6cd7ccdde6a200127bb3ea96d2749757cd0760599","observation_id":"25c85ac9-652d-4162-9564-6e7b74d75ba0","resolution":{"observed_at":"2026-08-10T19:39:48.161908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.651312Z","title":"Big data geospatial processing for massive aerial lidar datasets","venue":null,"work_id":"5987a54f-577b-4d4f-8c74-37c3bd70e54c","year":2020},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.166338Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:bd1d4447b2841692b6bb2ad8ec9f807b941c2afffe07f77fe262b0f6457aecb2","observation_id":"9064878a-9352-405a-9a10-9a7fd630f02f","resolution":{"observed_at":"2026-08-10T19:39:48.655452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07728","last_updated":"2020-12-16T12:56:44Z","snapshot_observed_at":"2026-08-13T19:13:37.206052Z","submitted_at":"2020-04-16T16:11:46Z","title":"Image Quality Assessment: Unifying Structure and Texture Similarity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07728","snapshot_observed_at":"2026-08-10T19:39:48.170408Z","title":"Simoncelli","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.170408Z"},"links":{"cited_paper":"/paper/2004.07728","citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:3fc125444033784ef4f5716823ba927303dc1a52f0b82e26e88d47d410bf6915","observation_id":"61af7d8e-6d06-4249-b4c0-d741c4437d20","resolution":{"observed_at":"2026-08-10T19:39:48.170408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.640688Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"5223bf7b-f327-4cce-a4ad-c8865ea94a1c","year":2021},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.174860Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:3ad1327e2b712c2a9ca8193d06efcb5f3fcd78666e1b4f90293086f5c0073802","observation_id":"c7f27f39-9f77-484d-9269-49c0d542160c","resolution":{"observed_at":"2026-08-10T19:39:48.644672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.630253Z","title":"Sur la distance de deux lois de probabilit´e","venue":null,"work_id":"4123e842-48d8-470d-bb92-4388de139569","year":1957},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.178679Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:46b305c897395463883183cbc88bfcabfac5fb22137555e801444fa351085dd3","observation_id":"c4f93213-4c61-4271-8c88-82acbfb4799e","resolution":{"observed_at":"2026-08-10T19:39:48.633902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.182202Z","title":"K-planes: Explicit radiance fields in space, time, and appearance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.182202Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:7bd314ebda123fd15a59afbaafb575c0235bd80e0c381085bd85c3653c00ac8b","observation_id":"7ce55944-a873-4c50-80e8-66ce1cbde07c","resolution":{"observed_at":"2026-08-10T19:39:48.182202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10314","last_updated":"2024-05-16T17:59:05Z","snapshot_observed_at":"2026-08-15T07:34:03.035482Z","submitted_at":"2024-05-16T17:59:05Z","title":"CAT3D: Create Anything in 3D with Multi-View Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10314","snapshot_observed_at":"2026-08-10T19:39:48.185661Z","title":"Cat3d: Create anything in 3d with multi-view diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.185661Z"},"links":{"cited_paper":"/paper/2405.10314","citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:3efd246345c852e284c16c6aa3a766fcd75d9aa75bee7b174495f3a93f7f1036","observation_id":"96dba94f-66ae-48c5-b96e-b7fdd3b07228","resolution":{"observed_at":"2026-08-10T19:39:48.185661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.613590Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification","venue":null,"work_id":"5b592a68-1e51-4f5a-8e12-42ed0c108d48","year":2019},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.189583Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:5ef33813218062a05968919d3d9be95f3c6bf14f8472635cb557764b9cd32a43","observation_id":"d4bcd503-61d5-4372-a539-a994bbc93baa","resolution":{"observed_at":"2026-08-10T19:39:48.617451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.193290Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.193290Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:69c7aef3102dedcac5df7e2d3effa4058b2f26e88edb7d2eaa16d1aa0753a4cc","observation_id":"acc40f5b-835d-46f9-bb71-eb6da3761f2b","resolution":{"observed_at":"2026-08-10T19:39:48.193290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04400","last_updated":"2024-03-09T10:47:51Z","snapshot_observed_at":"2026-08-18T01:50:26.644460Z","submitted_at":"2023-11-08T00:03:52Z","title":"LRM: Large Reconstruction Model for Single Image to 3D","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04400","snapshot_observed_at":"2026-08-10T19:39:48.196762Z","title":"Lrm: Large reconstruction model for single image to 3d","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.196762Z"},"links":{"cited_paper":"/paper/2311.04400","citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:7c7c1bf356bd138bea8895f51681303bbfc7ef80c902a61d7d233657127ebce6","observation_id":"1b9728ae-4927-4804-9114-125a93d5ea03","resolution":{"observed_at":"2026-08-10T19:39:48.196762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.596732Z","title":"Segmentation models pytorch","venue":null,"work_id":"1cec924e-a311-4aa9-963a-b7bbc03391ba","year":2019},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.200632Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:cd4c7fe5bc04eb8e5520ac3619985ead1a0d7df07563671ed0bcd5d4b7f59e80","observation_id":"a0e27922-41dd-41ec-a29d-a80d3737a89e","resolution":{"observed_at":"2026-08-10T19:39:48.600231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.585307Z","title":"Elucidating the design space of diffusion-based generative models","venue":null,"work_id":"0efc258f-6af6-4aef-958a-e6b2e3fe0b06","year":2022},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.203992Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:84d3e950c6a285d3472aea0be0b007b44c6e3c04061c143b6d2dfb8160052b74","observation_id":"d8a77532-4630-4fb3-9568-39565da01db2","resolution":{"observed_at":"2026-08-10T19:39:48.590127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.574013Z","title":"Analyzing and improving the training dynamics of diffusion models","venue":null,"work_id":"218d8039-890a-4170-81a7-b34035de6b06","year":2024},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.208523Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:97c314e32d1c7da6da21cfd32a2ca558ff218b5c20c5150b36ae9f95c0467ac1","observation_id":"e2872eba-c92e-4179-8ba5-03421cc00c39","resolution":{"observed_at":"2026-08-10T19:39:48.578154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.212543Z","title":"A style-based generator architecture for generative adversarial networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.212543Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:d0277bc35ddd927cf58642ab69792bb261d2d23a3cc3f2027b03bcd1584228ad","observation_id":"e8a1335a-5721-4447-95b9-4388a9a09ffa","resolution":{"observed_at":"2026-08-10T19:39:48.212543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.216717Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.216717Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:5c1022cb551bff77705b06ed1f9dd68d8d4de98ca96dcb7cfaff463bca106a8f","observation_id":"1280b52a-1827-48fb-a117-ad11e237bfd4","resolution":{"observed_at":"2026-08-10T19:39:48.216717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.221143Z","title":"Zero-1-to- 3: Zero-shot one image to 3d object","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.221143Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:1edcc6dabe969baceeb2aa5ccc418e5d4145e43cc4a3a49a0750f9e9d100acd0","observation_id":"b55007d3-9b14-405b-bec9-949a1b9ba5eb","resolution":{"observed_at":"2026-08-10T19:39:48.221143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.546973Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis","venue":null,"work_id":"2e0c56a8-746a-4d89-8648-0f6ae4c29999","year":2021},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.225280Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:105db9446571eda89b5601788a4813104d4c303c00d18d3f7b5fb582d7e66969","observation_id":"95fbd2ee-9765-4d6f-8860-a0226186666c","resolution":{"observed_at":"2026-08-10T19:39:48.550509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.228656Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.228656Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:48367743e4df4626297f659354bddf00635a87fc75fa76c1ad9e3554a7cec7db","observation_id":"ed7399bf-fb63-4091-a403-69c8c5f6b5a3","resolution":{"observed_at":"2026-08-10T19:39:48.228656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.530723Z","title":"The terrasar-x satel- lite","venue":null,"work_id":"bef1a9b1-6db6-4b30-89e3-da803316524e","year":2010},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.232079Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:948098d7077aa0330178e587a82e502727c419e3bed2b2908aca54aec08a0f02","observation_id":"c6ce1929-b7a1-44b1-815b-7a4d3f3ddd25","resolution":{"observed_at":"2026-08-10T19:39:48.534247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.235414Z","title":"Barron, and Ben Milden- hall","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.235414Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:7993dd308412370d6b10563f9430c730b629326adc72b587ec69372fd1ce8f6c","observation_id":"eb72f15d-1813-4f8e-96fc-a387d8bb2ebb","resolution":{"observed_at":"2026-08-10T19:39:48.235414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.514204Z","title":"Neural implicit surface reconstruction using imaging sonar","venue":null,"work_id":"1cef68a8-33f8-4a02-b211-87983d03621f","year":2023},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.239184Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:7bccf8272916738b449391d5ec6c905ee007cfb3da04b9c1e6925ede86d4a457","observation_id":"e32e8432-590c-4df3-8d1f-6ff519b435cf","resolution":{"observed_at":"2026-08-10T19:39:48.518292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.504490Z","title":"Blainder—a blender ai add-on for generation of semantically labeled depth-sensing data","venue":null,"work_id":"f71b5fb3-058d-471d-a376-60859d935df3","year":2021},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.242345Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:3580da48c9bf1c589ea500bbd2057408ba2fc3f4f45fe4e59465a11bc1a44558","observation_id":"a1f54fbb-57f7-4f88-b5ac-2fbeda7191a6","resolution":{"observed_at":"2026-08-10T19:39:48.508034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.245496Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.245496Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:40dfdf95e5bb63b1cad13a5425ca65e02a0ad68dcd25baef6ed9e92c06fc216c","observation_id":"15924a89-b0c2-4b4b-b0de-1df9edccabb5","resolution":{"observed_at":"2026-08-10T19:39:48.245496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.248731Z","title":"Zero123++: a single image to consistent multi-view dif- fusion base model, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.248731Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:c2325ba9c2b5f38186e0f24f8215a0b2cfb1260c147ea7ed8aa9723b4ac7c277","observation_id":"674f2fe9-156e-4a6e-9a49-91e6e4889722","resolution":{"observed_at":"2026-08-10T19:39:48.248731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-08-17T23:11:03.362702Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-10T19:39:48.251790Z","title":"Mvdream: Multi-view diffusion for 3d gen- eration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.251790Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:fbccb1be4c2d51c9fe237778e1bddc99861045b5e9dc44df98446ba158191670","observation_id":"63739e15-daec-4e92-b2ad-1697b2c7fa25","resolution":{"observed_at":"2026-08-10T19:39:48.251790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.482066Z","title":"Scene representation networks: Continuous 3d- structure-aware neural scene representations","venue":null,"work_id":"374c6347-f9cc-4376-8d81-f9fe12c7baff","year":2019},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.255549Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:a9b3526af9622f606611191bb2a9b3a09fa9485d55298fc97a6c8711db96ed71","observation_id":"7c0c0fd7-9d95-4d91-bb1f-39876abcb82a","resolution":{"observed_at":"2026-08-10T19:39:48.485617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.258715Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.258715Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:77805712010115166431728cfb235212466d279b9714b4e67d447a332957a7c5","observation_id":"8ac3c6f6-654e-4ea3-83c8-01f3f80b5cbb","resolution":{"observed_at":"2026-08-10T19:39:48.258715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-10T19:39:48.262748Z","title":"Score-based generative modeling through stochastic differential equa- tions","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.262748Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:ea0ec945cd55f1da99ceabf110ff9b80b3b5855dccbdc29abf6d2698c90aa2d3","observation_id":"24559e2e-9b50-4ad7-a9a3-50c611e512f6","resolution":{"observed_at":"2026-08-10T19:39:48.262748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.465088Z","title":"Learned initializations for optimizing coordinate-based neural representations","venue":null,"work_id":"aae752a3-714b-4226-ba36-a550f78b3807","year":2021},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.266494Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:8a7f9398592321de65fdd8b66987db37f30cf16789e3c7625ba3900316746dd6","observation_id":"73bb342f-fdaa-44b8-bd5b-def09e514aa1","resolution":{"observed_at":"2026-08-10T19:39:48.469875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16653","last_updated":"2024-03-29T08:39:23Z","snapshot_observed_at":"2026-07-06T16:25:05.493379Z","submitted_at":"2023-09-28T17:55:05Z","title":"DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16653","snapshot_observed_at":"2026-08-10T19:39:48.269664Z","title":"Dreamgaussian: Generative gaussian splatting for effi- cient 3d content creation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.269664Z"},"links":{"cited_paper":"/paper/2309.16653","citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:74d7e423e7e0eb823be3136671fee5923b1b5e1da09a6c6666a1bffbe0f6d202","observation_id":"5fa1e923-3fba-4f8e-a21d-60b2f8bfc355","resolution":{"observed_at":"2026-08-10T19:39:48.269664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02151","last_updated":"2024-03-04T16:00:56Z","snapshot_observed_at":"2026-07-06T17:39:16.540553Z","submitted_at":"2024-03-04T16:00:56Z","title":"TripoSR: Fast 3D Object Reconstruction from a Single Image","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02151","snapshot_observed_at":"2026-08-10T19:39:48.273522Z","title":"Triposr: Fast 3d object reconstruction from a single image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.273522Z"},"links":{"cited_paper":"/paper/2403.02151","citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:28b82cfc1ac15482c7f4adaaa9556d29be1f4e8282bbe0a765a63626261599ea","observation_id":"99daa7a5-48fb-428a-a61b-40f437c9814a","resolution":{"observed_at":"2026-08-10T19:39:48.273522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.454661Z","title":"Attention is all you need","venue":null,"work_id":"ede6b9b2-1c49-4f5f-a37e-9a95749d1b5b","year":2017},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.277058Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:e27684664b464fee8aeb58e21f7e591037e4772de7670d55141ecc1dd774d14f","observation_id":"eecaf55e-64b0-4ea0-b476-a3a5806badb5","resolution":{"observed_at":"2026-08-10T19:39:48.458281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.444149Z","title":"Barron, and Pratul P","venue":null,"work_id":"96cfd3cc-8498-41be-8a39-9bdb189ca42a","year":2022},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.280891Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:11e76c97d627ef9c8808292af7a810042d8dde1b212433dbdbcfd6f26bdae5d7","observation_id":"1ccd22a6-a411-4bf8-8024-f80e970f368f","resolution":{"observed_at":"2026-08-10T19:39:48.447854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.434718Z","title":"Neus: Learning neural implicit surfaces by volume rendering for multi-view reconstruction","venue":null,"work_id":"fa067022-242d-459f-b1ae-ffbb2a1cbc56","year":2021},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.284921Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:2ca7720c3dc9c4eaf6b9e20106817fef13a8e221c783ae90cd7c690366f3ca5d","observation_id":"da130585-1e7e-439b-89bd-38862ba53706","resolution":{"observed_at":"2026-08-10T19:39:48.438274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.288975Z","title":"Reconfusion: 3d reconstruction with diffusion priors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.288975Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:3468682bcd0752c6a53ef60693d574dae3bf0e8325a95952ba223c34fc1e3aa0","observation_id":"e3fa38c4-1cea-4829-a820-4de898c69cb0","resolution":{"observed_at":"2026-08-10T19:39:48.288975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.293187Z","title":"pixelnerf: Neural radiance fields from one or few images","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.293187Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:6aafb36afc9d99a7a7c47b1aff8bfa5262aece7b017c7488473965de3cb61d8c","observation_id":"542c8a54-7d9b-4efe-821c-6442da928e3c","resolution":{"observed_at":"2026-08-10T19:39:48.293187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.412371Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"4fd2b1c6-f43f-4a3c-aa39-0f972ec352d1","year":2018},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.297659Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:4fdf73450b9485882d620d06d648378de096dd96aa7912e13286b6c529a3a1c4","observation_id":"8febca6f-2f26-4bf5-8b2a-db364a3c82a0","resolution":{"observed_at":"2026-08-10T19:39:48.416222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:39:48.399524Z","title":"Sparsefusion: Dis- tilling view-conditioned diffusion for 3d reconstruction","venue":null,"work_id":"e84618b0-c70a-4a44-be2c-a4faf5131d86","year":2023},"citing_paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:48.301572Z"},"links":{"citing_paper":"/paper/2501.09838"},"observation_digest":"sha256:cd1eed0de908ef29f670fd37e0e2537b452e0d08fe7c850019cb124d12d257fb","observation_id":"82bb5265-a865-44a6-96ae-e90ee0206960","resolution":{"observed_at":"2026-08-10T19:39:48.405531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.09838","last_updated":"2025-01-16T20:56:32Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T19:13:52.079848Z","submitted_at":"2025-01-16T20:56:32Z","title":"CrossModalityDiffusion: Multi-Modal Novel View Synthesis with Unified Intermediate Representation"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2501.09838."}