{"as_of":"2026-08-13T13:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eb3f82ce46e9de155395beac95b3d964b9f7c691c4791c6aa0b450165dc9841b","coverage":[{"denominator":90,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":90,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:17:38.949058Z","state":"measured"},{"denominator":91,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":91,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T06:04:21.354744Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11183","snapshot_observed_at":"2026-08-05T06:04:21.354744Z","title":"OccScene: Semantic occupancy-based cross-task mutual learning for 3D scene generation.arXiv preprint arXiv:2412.11183, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07996","last_updated":"2026-07-20T17:34:32Z","snapshot_observed_at":"2026-08-07T09:38:31.708978Z","submitted_at":"2025-09-04T17:59:58Z","title":"3D and 4D World Modeling: A Survey","version":4},"reference_index":126,"source":"pdf_text","source_observed_at":"2026-08-05T06:04:21.354744Z"},"links":{"cited_paper":"/paper/2412.11183","citing_paper":"/paper/2509.07996"},"observation_digest":"sha256:67fb1b835dbd4f7f4d5e4a064b93708269edab28bd012b83ba719bad40ff36f5","observation_id":"00d79cd2-c35b-4ebd-b5f3-e81bd3d4c248","resolution":{"observed_at":"2026-08-05T06:04:21.354744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.11183/citation-record","integrity":"/paper/2412.11183/integrity","json":"/paper/2412.11183/citation-record.json","paper":"/paper/2412.11183"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.619572Z","title":"Semantic scene completion using local deep implicit functions on lidar data,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.619572Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:8c04d51607a13e1a3c7ce47576d8585222395c8b926599bf80b36779e1c6b7e1","observation_id":"34ffc061-ebd1-4543-a3f7-de2fc49111f3","resolution":{"observed_at":"2026-08-11T15:17:38.619572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.624048Z","title":"Kitti-360: A novel dataset and benchmarks for urban scene understanding in 2d and 3d,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.624048Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:7101e5422bb1f83eb5a570a3ff7c53f732d7b3ed8a8e82f1a1c1535db007eced","observation_id":"3f60cfd1-a2e8-4109-9299-4d0fdc5e8afd","resolution":{"observed_at":"2026-08-11T15:17:38.624048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.628170Z","title":"Anisotropic convolutional neural networks for rgb-d based semantic scene completion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.628170Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:407981b72bb7b85950bac4c0be076b3be7503d1a861b34d9326b5a0a4590126f","observation_id":"c5885906-c78a-40a0-9362-cbdd41b4b193","resolution":{"observed_at":"2026-08-11T15:17:38.628170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.631921Z","title":"From front to rear: 3d semantic scene completion through planar convolution and attention- based network,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.631921Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:d3d6616df8dba47537ea605831d39443aa1d632a7cf68b4b894b16c4b9fd7c11","observation_id":"1e9d0d2f-a000-4207-96f8-fa86a2c9ff2a","resolution":{"observed_at":"2026-08-11T15:17:38.631921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13959","last_updated":"2024-05-06T15:14:22Z","snapshot_observed_at":"2026-08-13T12:17:45.687104Z","submitted_at":"2023-03-24T12:33:44Z","title":"Bridging Stereo Geometry and BEV Representation with Reliable Mutual Interaction for Semantic Scene Completion","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13959","snapshot_observed_at":"2026-08-11T15:17:38.635467Z","title":"Stereoscene: Bev-assisted stereo matching empow- ers 3d semantic scene completion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.635467Z"},"links":{"cited_paper":"/paper/2303.13959","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:823391b751ed8d689aee522a926d3aa9676ec05aef75c68f63db2ed9c92a5889","observation_id":"7b2f793c-3625-4aec-81dc-f66ad87390f0","resolution":{"observed_at":"2026-08-11T15:17:38.635467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.639657Z","title":"Diffusion probabilistic models for 3d point cloud generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.639657Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:52c4512af64a7190e0a31563b19852f2cbd4c00abf979bd3c1f6d8204606c1d4","observation_id":"dfd7cb2a-2349-4b25-bfd8-8152c520418a","resolution":{"observed_at":"2026-08-11T15:17:38.639657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.643650Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.643650Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:c5d107f7d436dc7831684688c29a64fc3175aec20085d4ce37bd760e437ba473","observation_id":"4077c49f-dc53-4e54-b35e-d70719db641a","resolution":{"observed_at":"2026-08-11T15:17:38.643650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.647110Z","title":"Conditional diffusion process for inverse halftoning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.647110Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:4d425636a89f35ce8e9b635d27f28928cc08140524f0d09810176aff5abddb23","observation_id":"6fb0994b-7d52-4505-94ef-1f40c3f9ea4a","resolution":{"observed_at":"2026-08-11T15:17:38.647110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.650693Z","title":"One at a time: Progressive multi-step volumetric probability learning for reliable 3d scene perception,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.650693Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:f24d7da25bd52a9679edf0b2c8afe446888cc3db0dd013afa31f8a992c403525","observation_id":"3f140ba4-049d-4487-90f0-c530ddf65ec9","resolution":{"observed_at":"2026-08-11T15:17:38.650693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01661","last_updated":"2023-09-23T06:59:18Z","snapshot_observed_at":"2026-08-13T10:41:59.154745Z","submitted_at":"2023-08-03T09:56:31Z","title":"BEVControl: Accurately Controlling Street-view Elements with Multi-perspective Consistency via BEV Sketch Layout","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01661","snapshot_observed_at":"2026-08-11T15:17:38.654731Z","title":"Bevcontrol: Accu- rately controlling street-view elements with multi-perspective consistency via bev sketch layout,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.654731Z"},"links":{"cited_paper":"/paper/2308.01661","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:6b78f7a5eaad3266d46d7bc60549fd5697f4cbd7c6b2e9917a40ab44f95b3867","observation_id":"33c0a65c-d045-46e0-aed8-4b4fdf384d25","resolution":{"observed_at":"2026-08-11T15:17:38.654731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.659260Z","title":"Street-view image generation from a bird’s-eye view layout,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.659260Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:112f3859d86d616a10d50ff8176658b8bda90312183c988e68f88b4859ed27cc","observation_id":"14c7401c-bc6a-41cf-97bf-857490768e39","resolution":{"observed_at":"2026-08-11T15:17:38.659260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09777","last_updated":"2023-11-27T05:09:29Z","snapshot_observed_at":"2026-08-13T10:10:52.493348Z","submitted_at":"2023-09-18T13:58:42Z","title":"DriveDreamer: Towards Real-world-driven World Models for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09777","snapshot_observed_at":"2026-08-11T15:17:38.663353Z","title":"Drivedreamer: Towards real-world-driven world models for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.663353Z"},"links":{"cited_paper":"/paper/2309.09777","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:8d46cda40f7959576a46237f9acc513e1bd7eab64c1ecb416ce62658be7e9d50","observation_id":"d2627754-3a57-43ec-8f8c-c224e4679e9f","resolution":{"observed_at":"2026-08-11T15:17:38.663353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.10863","last_updated":"2018-10-25T13:17:33Z","snapshot_observed_at":"2026-08-07T09:09:39.188154Z","submitted_at":"2018-10-25T13:17:33Z","title":"GAN Augmentation: Augmenting Training Data using Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.10863","snapshot_observed_at":"2026-08-11T15:17:38.668391Z","title":"Gan augmentation: Augmenting training data using generative adversarial networks,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.668391Z"},"links":{"cited_paper":"/paper/1810.10863","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:3009984f795ed5fa8ae80722d2f8d48a9e0f0ee5ceeaf0ca20395657eeb460af","observation_id":"3bb0c5b2-8eb8-4099-a7ea-cfea31e2584a","resolution":{"observed_at":"2026-08-11T15:17:38.668391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04607","last_updated":"2024-02-17T01:43:45Z","snapshot_observed_at":"2026-08-13T11:22:26.436284Z","submitted_at":"2023-06-07T17:17:58Z","title":"GeoDiffusion: Text-Prompted Geometric Control for Object Detection Data Generation","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04607","snapshot_observed_at":"2026-08-11T15:17:38.673412Z","title":"Integrating geometric control into text-to-image diffusion models for high-quality de- tection data generation via text prompt,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.673412Z"},"links":{"cited_paper":"/paper/2306.04607","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:c061b60f0d152f1adbe2e20c191bf6ca7dc0a807546a4e2d17c53280b7112e1e","observation_id":"c0c66181-cab5-4ca6-a229-74f75dbbba3e","resolution":{"observed_at":"2026-08-11T15:17:38.673412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.677798Z","title":"Detdiffusion: Synergizing generative and perceptive models for enhanced data generation and perception,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.677798Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:ab272f8a0e53a61329b8b49223b90bc8fd6327e95b5e901b439fa63d10189f36","observation_id":"eb7f09a9-43ef-486c-83cb-8556fca7dad2","resolution":{"observed_at":"2026-08-11T15:17:38.677798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07574","last_updated":"2023-02-15T06:26:38Z","snapshot_observed_at":"2026-08-12T10:47:09.554460Z","submitted_at":"2022-10-14T06:54:24Z","title":"Is synthetic data from generative models ready for image recognition?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07574","snapshot_observed_at":"2026-08-11T15:17:38.681766Z","title":"Is synthetic data from generative models ready for image recognition?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.681766Z"},"links":{"cited_paper":"/paper/2210.07574","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:2b0c470a25adfb82339e6f6ef0849d3891917d384ce334ac06f67ab9acee2538","observation_id":"2da199c9-c244-41e3-a70c-97c72ab12a8b","resolution":{"observed_at":"2026-08-11T15:17:38.681766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13861","last_updated":"2024-02-05T14:41:35Z","snapshot_observed_at":"2026-08-13T11:54:24.001568Z","submitted_at":"2023-04-26T23:09:02Z","title":"The Parrot Dilemma: Human-Labeled vs. LLM-augmented Data in Classification Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13861","snapshot_observed_at":"2026-08-11T15:17:38.685939Z","title":"Is a prompt and a few samples all you need? using gpt-4 for data augmentation in low-resource classification tasks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.685939Z"},"links":{"cited_paper":"/paper/2304.13861","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:e0c22f749ca40a72826fbb721793ab72534b0c89ff1a917cf679f97f809c05f9","observation_id":"506a99c3-9128-4cdb-9537-371bd81b2e20","resolution":{"observed_at":"2026-08-11T15:17:38.685939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.915509Z","title":"Open- vocabulary object segmentation with diffusion models,","venue":null,"work_id":"1601c039-735d-4c23-9081-a46318d53226","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.689348Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:194ef51e622417ff54c2c335b68dfcfe46fc79d904c297993f98eafd7ceee1f0","observation_id":"215269cc-4b6b-40ad-a469-11c3e3daf151","resolution":{"observed_at":"2026-08-11T15:17:39.919313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.902271Z","title":"Datasetdm: Synthesizing data with perception annotations using diffusion models,","venue":null,"work_id":"7a466c74-ff56-4c47-8813-97d5d2cc3eb1","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.692928Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:5a2d49bcac8066f9aab8d0c76de4c806a6c0d99beb5057c5d81f1d74d0ff5337","observation_id":"47c0e50b-af33-4f10-af90-b9ec0dd520ab","resolution":{"observed_at":"2026-08-11T15:17:39.906831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06845","last_updated":"2024-04-11T04:17:13Z","snapshot_observed_at":"2026-08-13T00:57:30.544225Z","submitted_at":"2024-03-11T16:03:35Z","title":"DriveDreamer-2: LLM-Enhanced World Models for Diverse Driving Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06845","snapshot_observed_at":"2026-08-11T15:17:38.696378Z","title":"Drivedreamer-2: Llm-enhanced world models for diverse driving video generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.696378Z"},"links":{"cited_paper":"/paper/2403.06845","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:39b37d29fe85d329cd792b6dc0f3466d1977404efdbd744d53ad737cb12bd274","observation_id":"86dbedb4-5839-4270-929e-8b91890b3f7a","resolution":{"observed_at":"2026-08-11T15:17:38.696378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.890248Z","title":"Magicdrive: Street view generation with diverse 3d geometry control,","venue":null,"work_id":"4ee6a49d-fe13-4de3-b4a6-89dee59c304e","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.699796Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:1e8f1b3ab58e2245efec7c89234052390fdeafb4e19e54bbba6f55be345fe4ee","observation_id":"5554e65c-9c0e-497a-8eaa-6cec888fe268","resolution":{"observed_at":"2026-08-11T15:17:39.893999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.878809Z","title":"Driving into the future: Multiview visual forecasting and planning with world model for autonomous driving,","venue":null,"work_id":"61ae2ca6-724f-46ec-b2d9-be342ee64376","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.703116Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:336172fd30b21512592eccfb37c142254ae26a49b1068e783a258478f58f7f14","observation_id":"a952f508-6151-4c11-8a44-f53de17c6be9","resolution":{"observed_at":"2026-08-11T15:17:39.882540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.867652Z","title":"Monoscene: Monocular 3d semantic scene completion,","venue":null,"work_id":"d41a2afe-ae6f-4933-bc18-70c31d5bf69a","year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.706434Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:d40f2adc98d92234c36ebf92bea48a46a1aa9d888d4752dc46465c4ac1f56e14","observation_id":"dba3fd3c-1306-4919-b4fe-c0d947f299b9","resolution":{"observed_at":"2026-08-11T15:17:39.871115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.855980Z","title":"beta-vae: Learning basic visual concepts with a constrained variational framework,","venue":null,"work_id":"f5d7be3d-6060-48fe-a443-56d9fb7afa41","year":2016},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.709904Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:28ea118375a1794278b9e5231179b0f2628c58aeebf48bdd5cc8453b9d12eeed","observation_id":"66a64160-375b-4552-86b0-50210d0684c3","resolution":{"observed_at":"2026-08-11T15:17:39.859889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.844355Z","title":"Dif- fusion autoencoders: Toward a meaningful and decodable representation,","venue":null,"work_id":"86d9abc9-d989-41e8-ac82-79202881b48f","year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.713207Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:aeda14c51cb15a3d2aab06e1e94d56b94ceb8ae525b6711b51355757fcac6905","observation_id":"a6b2868f-82f0-4448-9994-6f925d534e5b","resolution":{"observed_at":"2026-08-11T15:17:39.848393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02346","last_updated":"2025-09-09T14:21:23Z","snapshot_observed_at":"2026-08-13T10:07:53.463309Z","submitted_at":"2024-02-04T05:03:22Z","title":"Closed-Loop Unsupervised Representation Disentanglement with $\\beta$-VAE Distillation and Diffusion Probabilistic Feedback","version":2},"cited_work":{"arxiv_id":"2402.02346","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.02346","snapshot_observed_at":"2026-08-11T15:17:39.131383Z","title":"Closed-Loop Unsupervised Representation Disentanglement with $\\beta$-VAE Distillation and Diffusion Probabilistic Feedback","venue":"cs.CV","work_id":"c5e61470-f224-4b70-b7b5-6ef0aa751d65","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.716833Z"},"links":{"cited_paper":"/paper/2402.02346","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:c5c9b1f866774b4a3a692dc95345ee680cf39797c0cbdfa24e2ac3d3cf4e6f0f","observation_id":"90880d72-466f-436e-b5db-9023e353d8e8","resolution":{"observed_at":"2026-08-11T15:17:39.138965Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.720393Z","title":"Deep mutual learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.720393Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:503587f8f0e2e13426812ab02165e00bd472b051d40a60c8db5649458e277ca3","observation_id":"fd3b8d37-8d85-4bf9-86a9-1d1be95d2a91","resolution":{"observed_at":"2026-08-11T15:17:38.720393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.823884Z","title":"Mutualnet: Adaptive convnet via mutual learning from different model configurations,","venue":null,"work_id":"7233f51d-3ab1-4c4c-a2c6-ea48af9aa211","year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.723808Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:de6f5fc826623b0d847ea3558f70ad272ec930736831b4e7638e3c33e3adcf7d","observation_id":"77a5c591-c922-44d9-b271-de0407df9227","resolution":{"observed_at":"2026-08-11T15:17:39.828084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.810536Z","title":"Spatial-frequency mutual learning for face super-resolution,","venue":null,"work_id":"21d49241-0fbb-4ffd-80ee-5abfe0041a00","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.727207Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:76a5cdc4b5fce46441e60e07a83fe1d078cbf431eb8db7c5bc7deffa8c81d27e","observation_id":"6feae582-e388-4fe3-8216-21e37d931bd4","resolution":{"observed_at":"2026-08-11T15:17:39.814916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.796824Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics,","venue":null,"work_id":"9111f990-74b3-409e-96c7-6056774b6dab","year":2015},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.730125Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:19f267b2a4f1299b6648dc0b979883524ba794aac905a749811f4620c2fc6cb8","observation_id":"4c04a817-dc65-4970-9fc8-048bff61efec","resolution":{"observed_at":"2026-08-11T15:17:39.801095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.784400Z","title":"Diffustereo: High quality human reconstruction via diffusion-based stereo using sparse cameras,","venue":null,"work_id":"dcf2f40a-ea0b-42aa-9fe1-053cbced5d9d","year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.733062Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:13b358a346c5b5c81b3480dd584596c8d8d966294edb6e080a5da4ce15d69888","observation_id":"d0d5610b-c52b-416e-9cfa-017851c5c5be","resolution":{"observed_at":"2026-08-11T15:17:39.788893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.772378Z","title":"T2i-compbench: A comprehensive benchmark for open-world compositional text-to-image generation,","venue":null,"work_id":"6e917501-1133-4174-99df-18fed0a54f1b","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.736098Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:06a780d645be55181370135e9840e7a4542345b57a5618d598ebd6f92299c7e8","observation_id":"ba585ef1-f558-4be4-825a-2e1a201d9249","resolution":{"observed_at":"2026-08-11T15:17:39.777107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.739684Z","title":"Adding conditional control to text-to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.739684Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:e631687217ff595e50996ccc51eceec01b87fd3c5ccf1eecdc28c1181e0a25f1","observation_id":"72a04be8-40b3-4a2d-9c13-f1e175f32bf3","resolution":{"observed_at":"2026-08-11T15:17:38.739684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.743604Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.743604Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:ad218f775fbda2ab65feb24144b7983354f20c3c39410d19bd14a1911c39544b","observation_id":"96e3ec6e-f776-4223-8583-36da43780d77","resolution":{"observed_at":"2026-08-11T15:17:38.743604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.746498Z","title":"Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation,","venue":null,"work_id":"24f8d83c-8c4c-4d65-ad49-9f2bdfeaa01a","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.747785Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:da6d65ebe209352367006b91ee707de3bfc6659e2bb0036488bf919b16786ba0","observation_id":"88d0a2b5-5c5f-4add-8b81-82591f46ff25","resolution":{"observed_at":"2026-08-11T15:17:39.749982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.751563Z","title":"Video generation models as world simulators,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.751563Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:6329506977e2cfd0e21e126796474141595ec385d41d99b9fac58db9b8163c3e","observation_id":"ea17a43f-7046-4464-aa90-df0368f6bea0","resolution":{"observed_at":"2026-08-11T15:17:38.751563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.728743Z","title":"Learning universal policies via text-guided video generation,","venue":null,"work_id":"fb420806-f8b3-4a28-84be-4b285378ce82","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.755227Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:e46bd5e764396b14249f8f8ec298971098287a4a7cdc536a15d4966cc9069d60","observation_id":"257f169a-bbf6-48b3-aab3-db40e16709cd","resolution":{"observed_at":"2026-08-11T15:17:39.732274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.717340Z","title":"Fetv: A benchmark for fine-grained evaluation of open-domain text-to-video generation,","venue":null,"work_id":"04f0efe4-7a9f-426b-9665-28444ed6cdec","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.759358Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:c9ab0f8fa05f54c1e07349b12e5b9cccd854475f259fd8abc6684d6ccdc485cc","observation_id":"0aa696aa-5867-4953-a53d-df554821f5ae","resolution":{"observed_at":"2026-08-11T15:17:39.721149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19438","last_updated":"2024-12-26T10:33:31Z","snapshot_observed_at":"2026-08-13T10:07:19.210851Z","submitted_at":"2024-03-28T14:07:13Z","title":"SubjectDrive: Scaling Generative Data in Autonomous Driving via Subject Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19438","snapshot_observed_at":"2026-08-11T15:17:38.763417Z","title":"Subjectdrive: Scaling generative data in autonomous driving via subject control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.763417Z"},"links":{"cited_paper":"/paper/2403.19438","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:21d30eace433e4d1483ca0a44b167d2c60f41bb43490d7e888ee85f0e7706c88","observation_id":"aa026b04-4c30-4876-96b8-9f92b096c80c","resolution":{"observed_at":"2026-08-11T15:17:38.763417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.706406Z","title":"Mars: An instance-aware, modular and realistic simulator for autonomous driving,","venue":null,"work_id":"1b0102e2-eabb-4cdb-a88b-8780906b10d6","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.767987Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:c0f204ded2b5167cfc53c079df87569b3a79c40451f70e1c469e5dfab809d3da","observation_id":"2dedf5a5-1a7e-49a9-a2d4-e4f52b22e282","resolution":{"observed_at":"2026-08-11T15:17:39.709973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01339","last_updated":"2024-08-18T14:26:31Z","snapshot_observed_at":"2026-08-13T04:49:57.842976Z","submitted_at":"2024-01-02T18:59:55Z","title":"Street Gaussians: Modeling Dynamic Urban Scenes with Gaussian Splatting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01339","snapshot_observed_at":"2026-08-11T15:17:38.771931Z","title":"Street gaussians for modeling dynamic urban scenes,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.771931Z"},"links":{"cited_paper":"/paper/2401.01339","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:9e8cfa586645e6648e12fb34f0a48b1b047fe2cdc59d721fc816a261179377eb","observation_id":"c250a812-30b1-47db-a068-3ed60efee732","resolution":{"observed_at":"2026-08-11T15:17:38.771931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.694587Z","title":"Diverse and aligned audio-to-video generation via text-to-video model adaptation,","venue":null,"work_id":"50ae22d3-86a2-4cde-b962-edc7396e2693","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.775752Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:a127bb291c90cd973e2fe5f2956afce48581a44de2c2f26458b8d1ffb013e62c","observation_id":"9da922bc-fa86-4471-a936-e6da4f3d9d92","resolution":{"observed_at":"2026-08-11T15:17:39.698322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.683613Z","title":"Bungeenerf: Progressive neural radiance field for extreme multi-scale scene rendering,","venue":null,"work_id":"484efeee-701b-4d39-8ce0-54a6816dc7cd","year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.779027Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:8a76f652478cb4719851214849623ae6d41c1258edb5c8fb0b11d6c818f8cbbc","observation_id":"414af088-1215-487b-bf13-0220d86d1538","resolution":{"observed_at":"2026-08-11T15:17:39.687445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.672413Z","title":"Street-view image generation from a bird’s-eye view layout,","venue":null,"work_id":"37cab699-3a22-4c39-ae35-138fcd0c6830","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.783433Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:c8002bdc775df11a372ddd8bf26c68998194bc0b2bdd7c932d19a9db03c81ed1","observation_id":"a9fcf7a6-9990-47e1-a093-216670d5a58f","resolution":{"observed_at":"2026-08-11T15:17:39.676227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.661250Z","title":"Panacea: Panoramic and controllable video generation for autonomous driving,","venue":null,"work_id":"4d43ee04-2268-468e-aa78-132390f08d05","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.786756Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:b530b6b7640b52d9cd552f11860f3988900dc11500cb53514797b0d24c22b363","observation_id":"98284cfd-0457-4232-bab9-9d307def2088","resolution":{"observed_at":"2026-08-11T15:17:39.665324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.648953Z","title":"Scaling Diffusion Models to Real-World 3D LiDAR Scene Completion,","venue":null,"work_id":"942fe522-0408-4c96-9f92-df3ba5d28d23","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.790140Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:0b86448cd1c1059550974d751bc6e296a70ad84734ab7e1e53be10723149cfb9","observation_id":"5a8172dd-6d9c-4005-bf53-b6ea4eed29a1","resolution":{"observed_at":"2026-08-11T15:17:39.653451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.636601Z","title":"Semcity: Semantic scene generation with triplane diffusion,","venue":null,"work_id":"acf562b2-0c61-4829-89a9-7d35c138d517","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.793617Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:330bde86ca9e43559185b1c6d3a0788281f12cc3bc91ab65c33d061ce95d56f0","observation_id":"28da310f-99f6-4901-836c-0d92264a48dc","resolution":{"observed_at":"2026-08-11T15:17:39.640762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.625118Z","title":"3d semantic scene completion: A survey,","venue":null,"work_id":"17e3501e-18b1-4008-9518-4c8b2ee67ec5","year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.797121Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:84d67f8334bba85d339dbec8b141ce846ab669457a214cf1dfe6e194f91e1bab","observation_id":"74a2bf58-f7d8-4812-9ff6-e73fa75692e0","resolution":{"observed_at":"2026-08-11T15:17:39.628789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.800889Z","title":"Semantic scene completion from a single depth image,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.800889Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:73966291df09ae90efd7847ace3422cca2a59e773a80c1d93910eeeb4b1d94e0","observation_id":"e208dd70-9beb-4131-a7f8-2bb1c61745fc","resolution":{"observed_at":"2026-08-11T15:17:38.800889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.606459Z","title":"Lmscnet: Lightweight multiscale 3d semantic completion,","venue":null,"work_id":"5dfa8e4e-30d0-4b8e-b167-5d41d1dbb8db","year":2020},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.804357Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:f59c78daa13ce7a1a9ed5c4134ba563b1cb7af2968026d49b7cc26a87fe7e627","observation_id":"46f9ae7c-7b77-4edd-aa38-19fc922fe48d","resolution":{"observed_at":"2026-08-11T15:17:39.610183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.595084Z","title":"Sparse single sweep lidar point cloud segmentation via learning contextual shape priors from scene completion,","venue":null,"work_id":"e789c76e-fbb4-459e-9267-20ca9d0ba1db","year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.808205Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:01ec4f8235549a16f6d6c32bb5268e002e68a3174d631edf189e20e0e7f25ee5","observation_id":"8b9d22e0-fdbc-4917-81fc-be1862d2e19d","resolution":{"observed_at":"2026-08-11T15:17:39.599072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.584037Z","title":"Scpnet: Semantic scene completion on point cloud,","venue":null,"work_id":"8addc6b2-bf61-4a73-a9ab-d610594b8b54","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.811840Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:a2a751d051a2280985a4b4450d3d13cbe2077599b25996ae5a417e29beef29e0","observation_id":"4663bc78-7743-41f7-8b53-05215c1695a6","resolution":{"observed_at":"2026-08-11T15:17:39.587993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.572826Z","title":"Pasco: Urban 3d panoptic scene completion with uncertainty awareness,","venue":null,"work_id":"ff7dca66-39e0-4b19-8c35-315819dfbcd4","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.815807Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:3fec68565762cb9337f63abaa5489a4e83c80d87c01fd9f4284f263e5c946c1e","observation_id":"59c57e58-97e4-480d-b16c-f6179b36cbe5","resolution":{"observed_at":"2026-08-11T15:17:39.576891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.562016Z","title":"Scenerf: Self-supervised monocular 3d scene reconstruction with radiance fields,","venue":null,"work_id":"91030cab-adcf-4072-8fef-f817d95f6e73","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.819260Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:6e1852d9948d60df38ebc9a523f6ab352a0b343dddacc09b4ba65cada0365230","observation_id":"cdbfd1bc-d8f0-475a-be00-bcf598a8482e","resolution":{"observed_at":"2026-08-11T15:17:39.565689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.549443Z","title":"Behind the scenes: Density fields for single view reconstruction,","venue":null,"work_id":"16ca0583-802e-4b46-8b65-2cdec5bdf825","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.823245Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:051e8758c54a36ab483cd2fad1b621feca9d0c61c15fe313728607b26ba2db42","observation_id":"efd83b71-e775-4080-97d4-5d346d39b05f","resolution":{"observed_at":"2026-08-11T15:17:39.553013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.538740Z","title":"Selfocc: Self- supervised vision-based 3d occupancy prediction,","venue":null,"work_id":"46a53a53-0d95-44a0-a79e-a803a87ff521","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.826727Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:c322a4bba85a6bcf6baf2094586b6cf83571b22d1b13d51101b2047c7a4c03a9","observation_id":"068c4a72-a5fc-4014-a2cd-1cdf856fc329","resolution":{"observed_at":"2026-08-11T15:17:39.542239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.525921Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"c2fed221-d407-4c11-9ef7-1e56ab411dd9","year":2012},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.830315Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:4a588ee32394dd468200eb2214b1e8d49abf74f862c45e0ff5a2fc349439108d","observation_id":"2939e033-a0d9-4a8c-bd64-3d27109fb9d3","resolution":{"observed_at":"2026-08-11T15:17:39.529895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.513930Z","title":"S3cnet: A sparse semantic scene completion network for lidar point clouds,","venue":null,"work_id":"9062d527-a98b-4539-a7e1-520a0bb50e18","year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.833596Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:db542fded042865cd1b939efd668c155fc682498c1648a5f5e665938bb34b208","observation_id":"5ed920e6-ac19-4d63-ac77-39ec33d5c670","resolution":{"observed_at":"2026-08-11T15:17:39.517997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.500842Z","title":"Scfusion: Real-time incremental scene reconstruction with semantic completion,","venue":null,"work_id":"d58c22a6-ea07-403e-bb9a-d669cfda3eac","year":2020},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.836937Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:cc78da7aaf6056a68d518de7e9eb225412c5086a91bb553a9453bbd5bd202227","observation_id":"5f9dc2a8-cd11-43ed-bf13-9d175f5fc68a","resolution":{"observed_at":"2026-08-11T15:17:39.505233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.488350Z","title":"V oxformer: Sparse voxel transformer for camera-based 3d semantic scene completion,","venue":null,"work_id":"2a65beb6-edaf-45a9-807a-88886c845e4e","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.840111Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:17abfc1e4fec2a453eeafb59af63084ed09e7e9481547df2a0542fb4860d1354","observation_id":"1c43f25d-9323-4596-924d-e8b6354afd85","resolution":{"observed_at":"2026-08-11T15:17:39.492545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.477623Z","title":"Hierarchical temporal context learning for camera-based semantic scene completion,","venue":null,"work_id":"995b1201-f91a-406e-8a98-1a87fa5e9fb8","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.843256Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:877cc87a3a8f97b1393772eb5c59e1cae42ab059db341008865f5f0bee2fd092","observation_id":"3fcf4c04-481e-4b4f-8ad2-00601c8eb048","resolution":{"observed_at":"2026-08-11T15:17:39.481147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.467264Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":"a9b97aac-98cb-4c14-ab36-d7ad2c3b9a16","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.846856Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:f37f4830c7a75bcd1719338cfc51706100d257a0e72fa22ce99a4cc006fc701d","observation_id":"ebd57e0a-b6af-4984-b84e-267a75d7340b","resolution":{"observed_at":"2026-08-11T15:17:39.470763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.456267Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":"feb359c2-a722-4e3b-b440-ad0437eaede7","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.850333Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:f024fce6c5a6ea777dc698f1935e0c61444a0c495a798aa5dc41fdd2b9848c36","observation_id":"1aa5774c-7f8d-4866-8aff-10afbd0e7c21","resolution":{"observed_at":"2026-08-11T15:17:39.459864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.445331Z","title":"Surroundocc: Multi-camera 3d occupancy prediction for autonomous driving,","venue":null,"work_id":"c258b4ac-bd1a-49a2-805d-a084abc68c4e","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.853919Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:465f994830782f3fe8be21d5712f639c0c917d7f72f33b1e078eca2f1c600a9e","observation_id":"3fd0244e-f6d6-4d23-af96-004c61dbaab3","resolution":{"observed_at":"2026-08-11T15:17:39.449198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.857159Z","title":"Image super-resolution via iterative refinement,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.857159Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:2fdf4caa36ff61c35b358919f7bda55d2ee94afefa3afc948fabd8f66b620856","observation_id":"af7597f6-2b15-4422-a6c0-80deb6348e3d","resolution":{"observed_at":"2026-08-11T15:17:38.857159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.860270Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.860270Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:2f5943cf99f058af6733ef814c4089ff2f4710578f8137f0f2e4bca93b853634","observation_id":"6ae6a2bc-6b28-44e3-8c54-f93a7b815758","resolution":{"observed_at":"2026-08-11T15:17:38.860270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-11T15:17:38.864281Z","title":"Prompt-to-prompt image editing with cross attention control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.864281Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:491c432e99b17f715421e913145787047ef04c5b6da230c8629455e9767f5af2","observation_id":"747f90ef-85a8-40fe-8dfc-7644ebdc3375","resolution":{"observed_at":"2026-08-11T15:17:38.864281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-11T15:17:38.868750Z","title":"Mamba: Linear-time sequence modeling with selective state spaces,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.868750Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:f31b84c7212d3c0abbb4df76a5a4e9f41eb96c4b5ed7aac101cea4096b5c8504","observation_id":"c4a55bc2-72b6-4333-a9bd-2afcf999b9d6","resolution":{"observed_at":"2026-08-11T15:17:38.868750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-11T15:17:38.873134Z","title":"Transformers are ssms: Generalized models and efficient algorithms through structured state space duality,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.873134Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:e9d89940d69fa444bd5faa2ff3a1fcbfba8a07186f34c8e9082bfd84abe30471","observation_id":"3ea7b3bf-d6bb-4fdb-87e0-2be3757c54af","resolution":{"observed_at":"2026-08-11T15:17:38.873134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10166","last_updated":"2024-12-29T14:57:13Z","snapshot_observed_at":"2026-08-13T10:13:02.973882Z","submitted_at":"2024-01-18T17:55:39Z","title":"VMamba: Visual State Space Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10166","snapshot_observed_at":"2026-08-11T15:17:38.877076Z","title":"Vmamba: Visual state space model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.877076Z"},"links":{"cited_paper":"/paper/2401.10166","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:3b841fe40c56c1c22f05d051445ff20d5fa74d148a82ba12721f9eb7a4fdff30","observation_id":"edd8b7b5-46c2-4e0b-a0d0-77d2595219b4","resolution":{"observed_at":"2026-08-11T15:17:38.877076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10739","last_updated":"2024-11-25T01:45:35Z","snapshot_observed_at":"2026-08-13T04:17:31.241808Z","submitted_at":"2024-02-16T14:56:13Z","title":"PointMamba: A Simple State Space Model for Point Cloud Analysis","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10739","snapshot_observed_at":"2026-08-11T15:17:38.881359Z","title":"Pointmamba: A simple state space model for point cloud analysis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.881359Z"},"links":{"cited_paper":"/paper/2402.10739","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:452fdc7316022ef0087428275f7e78b329e0f6286258bd6ede638ea789818905","observation_id":"4933e147-64c6-48c5-aa10-5623374b6a15","resolution":{"observed_at":"2026-08-11T15:17:38.881359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.420302Z","title":"On large-batch training for deep learning: Generalization gap and sharp minima,","venue":null,"work_id":"b3cf82dc-68d3-4f25-b851-b2e1a770a6fe","year":2017},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.886004Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:1b28466d668b48b42fe39d180251282617d4679296ad437723ffd4f540a946dd","observation_id":"92269d5c-0144-46fa-af0c-92668e5037fe","resolution":{"observed_at":"2026-08-11T15:17:39.424241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.407592Z","title":"Entropy-sgd: Biasing gradient descent into wide valleys,","venue":null,"work_id":"0ca33131-fa2a-430f-973e-0b6cf3b89f30","year":2019},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.889300Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:ba641ffaa11b1eca514df1ceaa820b0cc801021942acb88bbb0e51e82e6f0b00","observation_id":"68020358-6bfc-48c4-a366-e6fefbc5b5a7","resolution":{"observed_at":"2026-08-11T15:17:39.411985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.396122Z","title":"Understanding deep learning requires rethinking generalization,","venue":null,"work_id":"a8780d29-87af-4dde-87ea-cb5075711f98","year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.892494Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:8581d19be2c4d24b8b09ca2847ad9b5d26802a3502a99faa7365bfe2742ab7b1","observation_id":"af9dc410-49e4-4757-a7ce-6a3d49a21c8a","resolution":{"observed_at":"2026-08-11T15:17:39.399920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.382391Z","title":"Semantickitti: A dataset for semantic scene understanding of lidar sequences,","venue":null,"work_id":"7d97e779-0bb5-41de-b02f-9ecf23eb92ec","year":2019},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.896025Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:6eb9fd8c39dad4703ca8ea32a1f26eafcc7be8a8cb2948dc591e01b587fd7a36","observation_id":"0f4aa893-2488-424f-a026-acf4f0b1bd6e","resolution":{"observed_at":"2026-08-11T15:17:39.386849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.899494Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.899494Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:d80b20bf578d93e6db8c877b4ce0a73e5ca2e74639083f2dd9583ead134b6887","observation_id":"2a3bc838-3c8d-47ba-bec3-4a2eb7c14053","resolution":{"observed_at":"2026-08-11T15:17:38.899494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.360879Z","title":"Openoccupancy: A large scale benchmark for surrounding semantic occupancy perception,","venue":null,"work_id":"fe10c789-670a-4bdb-b01c-fa96b699b0fb","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.902746Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:800b9ac0da512dc57b24b7c9fde8d6ab17a0d96404d5c15f0b526b2b16f4d0ba","observation_id":"a02949bc-ac76-477a-afd6-9523cfd6766c","resolution":{"observed_at":"2026-08-11T15:17:39.365419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.906205Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.906205Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:2469da6c98d115411c187779839f10614d60647d7d89c8a0d2ee173b11c7d1d7","observation_id":"702ece8e-a496-4fb2-8096-d9eab55af711","resolution":{"observed_at":"2026-08-11T15:17:38.906205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-11T02:30:38.877941Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-11T15:17:38.909781Z","title":"Towards accurate generative models of video: A new metric & challenges,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.909781Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:62040d720745d6ca48582b2fa13007b36fa9e43028e9460f3eb518cfca893b5e","observation_id":"a671182f-25e0-4639-bd40-3e4c14c4e29b","resolution":{"observed_at":"2026-08-11T15:17:38.909781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.338649Z","title":"Drivegan: Towards a controllable high-quality neural simulation,","venue":null,"work_id":"09a9ba0e-e808-4b45-8fee-fdfcad6c643f","year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.913600Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:40c5b30905e6a2bd919d05294ecf440e086316338e83ac2fa12220d82c454053","observation_id":"d3573c98-158c-4b94-a187-4062c100de74","resolution":{"observed_at":"2026-08-11T15:17:39.342955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.325852Z","title":"Anisotropic convolutional networks for 3d semantic scene completion,","venue":null,"work_id":"ab16fa07-097c-4f25-bda3-05c43b573127","year":2020},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.916890Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:db3b103712ad1552f8a7f849a142a8fe182db0b0054b8fc830ccf7491334399a","observation_id":"cf5fdd99-1683-4f5a-a7c1-ba875cd26f84","resolution":{"observed_at":"2026-08-11T15:17:39.330242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.312381Z","title":"3d sketch-aware semantic scene completion via semi-supervised structure prior,","venue":null,"work_id":"3f144acb-8665-432e-9d0b-18c037a6b84a","year":2020},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.919945Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:50842aa9aefefe522d528d537c8c150e927a4c281a60409910492fc23ba56708","observation_id":"71a89345-130d-4e56-8fcd-099dbc19d5c2","resolution":{"observed_at":"2026-08-11T15:17:39.317277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.299924Z","title":"Ndc- scene: Boost monocular 3d semantic scene completion in normalized device coordinates space,","venue":null,"work_id":"365d3ed6-2121-4895-8af5-7cb166f60251","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.923683Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:e8d8816801a0521e6f80af61708889721ccd7ee31dc77d6c33ab25120ed077ce","observation_id":"7c3a4899-2639-4f64-807b-283cce2a98ae","resolution":{"observed_at":"2026-08-11T15:17:39.304006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.287153Z","title":"Monocular occupancy prediction for scalable indoor scenes,","venue":null,"work_id":"dfb87926-8c7a-45d8-b4ea-a2e5ef7a8b1a","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.926849Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:539b4d3ae0a73f7ce76030729354604915dc89ad53a389c4ee7afeea56b96ac3","observation_id":"09556103-4435-4242-a3e6-074c78b409c3","resolution":{"observed_at":"2026-08-11T15:17:39.291699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13675","last_updated":"2024-10-22T14:28:56Z","snapshot_observed_at":"2026-08-13T00:02:08.851577Z","submitted_at":"2024-05-22T14:16:30Z","title":"Context and Geometry Aware Voxel Transformer for Semantic Scene Completion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13675","snapshot_observed_at":"2026-08-11T15:17:38.930081Z","title":"Context and geometry aware voxel transformer for semantic scene completion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.930081Z"},"links":{"cited_paper":"/paper/2405.13675","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:7d7e6ca2921ba9e4abd112ee5c7ff0728d5b575aff5b0776eee70b409158ee8e","observation_id":"384841ea-e68c-41a0-ba2c-0b94423eeaab","resolution":{"observed_at":"2026-08-11T15:17:38.930081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00527","last_updated":"2023-01-02T05:00:11Z","snapshot_observed_at":"2026-08-13T13:10:59.354615Z","submitted_at":"2023-01-02T05:00:11Z","title":"Diffusion Probabilistic Models for Scene-Scale 3D Categorical Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00527","snapshot_observed_at":"2026-08-11T15:17:38.933482Z","title":"Diffusion probabilistic models for scene-scale 3d categorical data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.933482Z"},"links":{"cited_paper":"/paper/2301.00527","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:8e1679b3593a3b4ba46965cd51ba9474c9ed6054bee3b7acccacc5815e3c142a","observation_id":"ff28915d-7ffc-4f6d-a422-421a548da20f","resolution":{"observed_at":"2026-08-11T15:17:38.933482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.01401","last_updated":"2021-01-14T05:36:59Z","snapshot_observed_at":"2026-08-13T06:40:48.610500Z","submitted_at":"2018-01-04T15:25:26Z","title":"Demystifying MMD GANs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01401","snapshot_observed_at":"2026-08-11T15:17:38.937354Z","title":"Demystifying mmd gans,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.937354Z"},"links":{"cited_paper":"/paper/1801.01401","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:4a5a7e6aec320687a4bd6db7284c43551cfcd0906ef2ae4349ebd68887d1f789","observation_id":"94c0904c-fa45-4ee7-b530-e5072296a571","resolution":{"observed_at":"2026-08-11T15:17:38.937354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.274813Z","title":"Diffusion convolutional recurrent neural network: Data-driven traffic forecasting,","venue":null,"work_id":"2c05c488-79b5-4949-b3e0-e677d993d19b","year":2018},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.940884Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:441bda86727c3390aaf21f6a3c123f84b75f9223fcb1cd25c3f51753c8d75538","observation_id":"6460a67b-08ad-4d58-a378-6ad639f04771","resolution":{"observed_at":"2026-08-11T15:17:39.278892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.261529Z","title":"A review of recurrent neural network-based methods in computational physiology,","venue":null,"work_id":"09508dbb-d800-45b6-94bf-2d1501bc1642","year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.944640Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:3bf848d3ea60f301cfabb0ad492f5ae8f509ab42172276cb036911bbedd78a76","observation_id":"d09b5847-e5e4-4d6d-8237-e968c5c3f317","resolution":{"observed_at":"2026-08-11T15:17:39.266023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.247230Z","title":"He was a Sr","venue":null,"work_id":"9a91e83a-19a9-4035-a526-ec62a8be0ece","year":2014},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.949058Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:cf81d226833ad2cb68879c6a5cd5c2af6534f774e5354ba6628334e294e74bce","observation_id":"80664b1a-2c01-449c-8355-7b4047b1ffa3","resolution":{"observed_at":"2026-08-11T15:17:39.251691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T08:43:37.840225Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation"},"reference_resolution":{"displayed":90,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":1,"verified_fuzzy":51},"total_outbound_references":90},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 90 of 90 outbound references and 1 inbound Pith citation observation for arXiv:2412.11183."}