{"as_of":"2026-08-08T19:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c45134966652cd1df419734f85db4433761e8a2ecdf7b38baa0b3400b3024231","coverage":[{"denominator":95,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":95,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:48:19.411266Z","state":"measured"},{"denominator":95,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":95,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.17661/citation-record","integrity":"/paper/2507.17661/integrity","json":"/paper/2507.17661/citation-record.json","paper":"/paper/2507.17661"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:16.907174Z","title":"Learning representations and generative models for 3d point clouds","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:16.907174Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:2af50f6540ccd71105cde5b4fd0c8171aa50e474bb2be37740295c2106d2aa10","observation_id":"48dcfd1a-5fc6-44f1-b68d-15a12d6bafd9","resolution":{"observed_at":"2026-08-06T14:48:16.907174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:16.957061Z","title":"Rangevit: Towards vision transformers for 3d semantic segmentation in au- tonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:16.957061Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:315f7486da8d78de6814221ed71b9105c1735f2e6b9b4b4695663f8ed464077a","observation_id":"251dca42-ccf5-4b0c-9808-540b225e583c","resolution":{"observed_at":"2026-08-06T14:48:16.957061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:16.966499Z","title":"Se- mantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:16.966499Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:dbaab48eef7658c6e243dec1dad57d76c518b8d2a314fc89a43631b2d31ab5d7","observation_id":"526702ca-5e11-4d11-84ad-4b999fdf441a","resolution":{"observed_at":"2026-08-06T14:48:16.966499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.001941Z","title":"Adabins: Depth estimation using adaptive bins","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.001941Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:99a098208d04fce445ae8874d6049cd9381824354bb25a71e6bf08b7166d6bfe","observation_id":"447aab46-34ce-4239-9c50-9ca6c2e5df48","resolution":{"observed_at":"2026-08-06T14:48:17.001941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.106824Z","title":"Dynamiccity: Large-scale 4d oc- cupancy generation from dynamic scenes","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.106824Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:9749047625391e7e1c03cc33b1a5992a4d81bd2391c910741f3ea77b93ca94fb","observation_id":"1a710fb6-3a30-47f8-9924-f3a78099190b","resolution":{"observed_at":"2026-08-06T14:48:17.106824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.155892Z","title":"Also: Automotive lidar self- supervision by occupancy estimation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.155892Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:b6951b831540dd09715d00c9c3e770492de78cca83f9984234dcf5c1dc8cfbaf","observation_id":"afbdc047-1976-4615-a5b4-5bcff04356a0","resolution":{"observed_at":"2026-08-06T14:48:17.155892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.208912Z","title":"Monoscene: Monoc- ular 3d semantic scene completion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.208912Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:c00461785bf7d4d7c08453924bf4f0a5f4834d53df40a63be733af490df87fd4","observation_id":"cdc61ab5-9b11-4f8d-b226-0aa3a427c2c3","resolution":{"observed_at":"2026-08-06T14:48:17.208912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.256747Z","title":"Scenerf: Self- supervised monocular 3d scene reconstruction with radiance fields","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.256747Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:40e599b2e1dd214896ab671f770c11acbaa35ccb2f684ea09f9281a64d6efb0b","observation_id":"2b21083c-ae66-49bc-a100-3229a5569f92","resolution":{"observed_at":"2026-08-06T14:48:17.256747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.325750Z","title":"Pcam: Product of cross-attention matrices for rigid registration of point clouds","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.325750Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:3de9801021c6da892271af985d92a4c31891efd74ded23402668d126cfd76560","observation_id":"1c609932-9295-4432-8e29-e06197566ac2","resolution":{"observed_at":"2026-08-06T14:48:17.325750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.426935Z","title":"Pasco: Urban 3d panoptic scene completion with uncertainty aware- ness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.426935Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:e8b0d1388125b0235b6094a42b9afe3ab14186a25907bffdca2577075cd0bd14","observation_id":"62df9be9-a606-4e9d-b5da-57206142ab56","resolution":{"observed_at":"2026-08-06T14:48:17.426935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.476952Z","title":"Building a strong pre- training baseline for universal 3d large-scale perception","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.476952Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:28a412aadd43baf07d15208e8ae9d50ef58b4ef6d2cafa9aedffa5bb907647be","observation_id":"70ac1650-bda7-49ae-91f5-21685e722968","resolution":{"observed_at":"2026-08-06T14:48:17.476952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.573576Z","title":"Sca-cnn: Spatial and channel-wise attention in convolutional networks for image captioning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.573576Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:138df684c668d466d3b11b1c5be59d02384c8f03f93a893bc2bf807f3f93d73a","observation_id":"0a803a4f-23f3-439a-b359-6f61f46916e1","resolution":{"observed_at":"2026-08-06T14:48:17.573576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.620565Z","title":"Towards label-free scene understanding by vision foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.620565Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:8bd1718f6b910aab66779460ab825f37509cf1345b99ecb80027f892a2f7648c","observation_id":"8101bed2-1e9e-4a13-b308-f8c3c998602e","resolution":{"observed_at":"2026-08-06T14:48:17.620565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.686229Z","title":"Clip2scene: Towards label-efficient 3d scene understanding by clip","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.686229Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:4d843fbb9bd207dba77c132785b2da763e431a6df8ed2bd8206f435b36eff197","observation_id":"6e26ce5a-1c04-4718-b510-e4016d81dd89","resolution":{"observed_at":"2026-08-06T14:48:17.686229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.737417Z","title":"3d sketch-aware semantic scene comple- tion via semi-supervised structure prior","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.737417Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:882f66aa32960f2f839e513ebc511dc48629ec2580a1ce7ba1e0a0ca58a4ee89","observation_id":"755bbd5c-991b-4f29-b287-0c62a962df2b","resolution":{"observed_at":"2026-08-06T14:48:17.737417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:22.703210Z","title":"S3cnet: A sparse semantic scene completion net- work for lidar point cloud","venue":null,"work_id":"bb547a05-0ee2-4a3c-b674-442453c30d3a","year":2021},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.789786Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:5bac225bd1172bd8d2dc0bf9e210a6f16872f0d634995b9a19bb44d200548b63","observation_id":"734a8934-88be-4280-a7da-f2dd77b64e49","resolution":{"observed_at":"2026-08-06T14:48:22.757988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:22.586444Z","title":"Af2-s3net: Attentive feature fusion with adap- tive feature selection for sparse semantic segmentation net- work","venue":null,"work_id":"3f4fb2d1-a133-4617-8cdf-abb75ae38a44","year":2021},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.825026Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:474f393e25b77bb3db7f7f4b6cd19b16d8644f183f5de8cd83608d13c469786d","observation_id":"2fa5f261-4692-4a00-befd-1e8e8ba3fe74","resolution":{"observed_at":"2026-08-06T14:48:22.627722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:22.452629Z","title":"4d spatio-temporal convnets: Minkowski convolutional neu- ral networks","venue":null,"work_id":"92a848c5-bff4-4201-96e6-48782bfafcdf","year":2019},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.869369Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:613e5b8add0fa0f736fe81ec9ef79e9334d0e80d479dc2143a692a9b1d08d8cb","observation_id":"5580e8ed-5639-4cbd-a071-6fcaf8eb1cc2","resolution":{"observed_at":"2026-08-06T14:48:22.516073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:22.250723Z","title":"3d-r2n2: A unified approach for single and multi-view 3d object reconstruction","venue":null,"work_id":"fc452ea5-33ca-447a-b341-292a1b1e55a4","year":2016},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.914819Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:291b88e44553c6c58e89edf29e26f7f27465c456d47e23f7318ddf21fa7993e4","observation_id":"977d25eb-89cc-4d48-8a8b-db34678bb3e1","resolution":{"observed_at":"2026-08-06T14:48:22.335106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:22.033403Z","title":"Buol: A bottom-up framework with occupancy-aware lifting for panoptic 3d scene reconstruction from a single image","venue":null,"work_id":"081310f6-c6c1-4b25-a5f1-41bd76545037","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.947273Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:af0bc14d3b8efe41ced1a0e0d01b696ff0c3bd037a0eed6058c63e34174ec986","observation_id":"d1258f43-1fd8-4a7f-899c-a52a8b242755","resolution":{"observed_at":"2026-08-06T14:48:22.164932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.910346Z","title":"Panoptic 3d scene reconstruction from a single rgb image","venue":null,"work_id":"51aee301-cc00-45b7-b4ea-528887832412","year":2021},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.014960Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:a7199ab2f36ea34179f179e4bdf369c01f127e9d905f17ec835dc573601bfe45","observation_id":"28729733-025c-41c5-a72c-c7e9ec6b6564","resolution":{"observed_at":"2026-08-06T14:48:21.943090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.717458Z","title":"V ote3deep: Fast ob- ject detection in 3d point clouds using efficient convolu- tional neural networks","venue":null,"work_id":"7f48d65f-91ba-4e2b-a88f-8ed8dca77b7c","year":2017},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.089961Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:d250ad077652bdb4d1ce4c854f99ad2792716a293fe72fb66406498e7919f260","observation_id":"fbea67ad-7d61-4d3e-8a40-d8f583726e12","resolution":{"observed_at":"2026-08-06T14:48:21.791250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.645697Z","title":"A point set generation network for 3d object reconstruction from a sin- gle image","venue":null,"work_id":"8984cfa4-f438-4155-b1e7-cce523f9dece","year":2017},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.136015Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:5c43edacf0f1d1cb98f315d5ce027753aeede41d3e0ec6cf67014128ca2c49f4","observation_id":"aaa46ab6-a6cd-4581-8e7d-b4d6d0cf6e62","resolution":{"observed_at":"2026-08-06T14:48:21.676511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.583244Z","title":"Are we ready for autonomous driving? the kitti vision bench- mark suite","venue":null,"work_id":"93a3f77f-6ded-4c96-89d5-83e7e690765e","year":2012},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.211265Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:78712c9f37b4d849325ae30647f5fc4f0f1742d3c54b5c59f3aca427a1488a6a","observation_id":"cbfb0ad0-1031-446f-a0ea-7a6d3d48004e","resolution":{"observed_at":"2026-08-06T14:48:21.609526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.01307","last_updated":"2017-06-05T13:25:24Z","snapshot_observed_at":"2026-08-07T17:28:18.540810Z","submitted_at":"2017-06-05T13:25:24Z","title":"Submanifold Sparse Convolutional Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.01307","snapshot_observed_at":"2026-08-06T14:48:18.298271Z","title":"Sub- manifold sparse convolutional networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.298271Z"},"links":{"cited_paper":"/paper/1706.01307","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:e89eeecb29337eec4af05d18f6b6e2c22a3428c9dec207bd8a54389b3c3de32e","observation_id":"33233272-89aa-48a4-8e6b-81b9bf712907","resolution":{"observed_at":"2026-08-06T14:48:18.298271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.543080Z","title":"Scenenet: Understanding real world indoor scenes with synthetic data","venue":null,"work_id":"e659921f-db2f-419f-a81a-7ab6129851c4","year":2016},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.332673Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:9bc386fc72dc9711b0249214c2a472fc8bdd8552ad5ab3da4823f553bd8ce006","observation_id":"6f3c159e-5054-48b6-9f6c-8aeed6d320bf","resolution":{"observed_at":"2026-08-06T14:48:21.555758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.493347Z","title":"Is your hd map constructor reliable under sensor corruptions? In Advances in Neural Informa- tion Processing Systems, pages 22441–22482, 2024","venue":null,"work_id":"bad4909e-4279-4eed-a434-0eb1b3b35c4c","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.392729Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:88cf3cb2730f9df5c4c288586e9cd42467ba5b50a30f52fbb35927ae104fd246","observation_id":"a4842c5a-e8f6-4382-bf66-7dc59b1c4eb1","resolution":{"observed_at":"2026-08-06T14:48:21.515272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.470272Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"7e826d6a-9ad0-4883-8797-3811376aec02","year":2016},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.450996Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:c3f6314e0306f4c7098b26840c4445b420cd43135714e276d06f5ba9c31f7544","observation_id":"0716d4b5-2977-4ce8-96ba-03f48fa43d8f","resolution":{"observed_at":"2026-08-06T14:48:21.478969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.442531Z","title":"Unified 3d and 4d panoptic segmentation via dynamic shifting networks","venue":null,"work_id":"90401338-6a61-4901-aba9-da4f7c497e7e","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.542798Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:d5aedf65cacfb6406351eeaac46b31eba4771626089d3ed70ea898055029aa2f","observation_id":"859b53f4-10f7-4be9-aa99-3d6d48d13fc0","resolution":{"observed_at":"2026-08-06T14:48:21.451793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.419958Z","title":"Squeeze-and-excitation networks","venue":null,"work_id":"ad82ea0f-f358-4e5d-a297-5633f09bf222","year":2018},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.565744Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:17df80b3148458caf682ab7b0ffc1f0cb1221cdb7427caa41f10afc20a027d31","observation_id":"40c5c788-476d-4413-950a-1545d801eda6","resolution":{"observed_at":"2026-08-06T14:48:21.426288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.396901Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction","venue":null,"work_id":"c3154cc5-41a9-4b3d-aea8-5dca6e2565e0","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.613278Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:3f6853b0e91bd2c766588f33ac2db6649baed514bd15116323b89c587b005fea","observation_id":"a77cdafc-d798-4751-b33f-04d6275403a0","resolution":{"observed_at":"2026-08-06T14:48:21.404733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.378825Z","title":"Sym- phonize 3d semantic scene completion with contextual in- stance queries","venue":null,"work_id":"5959bce6-81f2-4105-93fd-03cb3f36ffae","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.713933Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:2186e6a13ae60814ba635eef98c4e411f23991eaaa757469668abbf605a0f42f","observation_id":"b8f4e1d5-e163-4fa4-a4d8-89bfd214b92c","resolution":{"observed_at":"2026-08-06T14:48:21.384276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.354531Z","title":"Rethinking range view representation for lidar segmentation","venue":null,"work_id":"b7d3bb00-906e-4dda-b750-c3da5aad5ad4","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.786593Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:4b1fcd8ffcae16e0680731e4345e05cd657e2a85bd41a787b1321d4a01b7a63b","observation_id":"2478527c-65c8-4df0-871f-3aadb1bdd198","resolution":{"observed_at":"2026-08-06T14:48:21.363987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.333215Z","title":"Benchmarking 3d perception robustness to common corruptions and sensor failure","venue":null,"work_id":"e9d39cc9-d064-4383-b14e-57ad56441580","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.895392Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:e6094209e84518481dbf4aa3e73f8f064666448e116237ac2614ffd5968d8c68","observation_id":"f795df28-5060-45ba-8e1b-ccc0216f3525","resolution":{"observed_at":"2026-08-06T14:48:21.340211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.312399Z","title":"Robo3d: Towards robust and reliable 3d perception against corruptions","venue":null,"work_id":"f736b9e3-8004-48b8-a03d-6d9743eba9c4","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.959879Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:bd4d2d70e8200d39ebfbc7b6d5f79aef4dde11e9859c0309700489a8c0f0602b","observation_id":"aad24054-2f10-4d92-8f9e-58f27c1747ed","resolution":{"observed_at":"2026-08-06T14:48:21.318131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.294664Z","title":"Lasermix for semi-supervised lidar semantic segmentation","venue":null,"work_id":"dbb1fd12-b064-4764-9188-a16ea3eae958","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.013550Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:289806daf29fd21e255fb5b1479cc9cd8d93009bb789f5b93728c30535a8bdb3","observation_id":"20a28033-1448-4300-862b-35006effe06f","resolution":{"observed_at":"2026-08-06T14:48:21.300395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.276890Z","title":"Cottereau, and Wei Tsang Ooi","venue":null,"work_id":"dd6f375b-f668-4131-bcf4-ebe7d1178f4f","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.094543Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:2839e9cb066430aa88d7cee448343c5d0951b38f1b68c4b376521e25b0319650","observation_id":"dec0a9ec-1d5f-49ab-84af-5e4f0630f6d3","resolution":{"observed_at":"2026-08-06T14:48:21.282288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.04005","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:19.919573Z","title":"Largead: Large-scale cross-sensor data pretraining for au- tonomous driving","venue":null,"work_id":"13d8787f-7f1a-484b-bcf4-0e1a1d5bee2f","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.099125Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:f3584bfd61389c5631a9d17a23faf42c4da5c0047f95d76eaa2e4631dcd03b9b","observation_id":"bbb32cdb-accc-4ca8-be0f-35ee8bf77bc6","resolution":{"observed_at":"2026-08-06T14:48:19.933795Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.259096Z","title":"Multi- modal data-efficient 3d scene understanding for autonomous driving","venue":null,"work_id":"52734ee3-e10d-40b4-8d0e-20141d21ab7a","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.104981Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:e92a89974958123c2e8ea57d6396174a22a762daac26cf03884c65f9a8f346ee","observation_id":"beedc11c-2919-4df2-a243-1e029f9e156b","resolution":{"observed_at":"2026-08-06T14:48:21.264751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.244218Z","title":"Hierarchical temporal context learning for camera-based semantic scene comple- tion","venue":null,"work_id":"4cecb4e8-3720-4b8d-a463-540efc66a4af","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.111274Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:b738a74484a989f4e10dc5013795eebdc2b88cbfc5b07ba21bc5318347381bf8","observation_id":"2479dd20-e8a8-4d93-b29e-ae5532f06b0d","resolution":{"observed_at":"2026-08-06T14:48:21.248516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.228820Z","title":"Brgscene: Bridging stereo geometry and bev representation with reliable mutual interaction for se- mantic scene completion","venue":null,"work_id":"7b6fc86e-4d53-498e-b840-368a80338e58","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.116765Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:2cbf17dd8a84ea25bdf9229582bb1b3ff3928cc0fbb6b2c676eb47d9e46cba86","observation_id":"36a15ca0-751d-42c7-8ab2-90ac23a5f60a","resolution":{"observed_at":"2026-08-06T14:48:21.233427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.209198Z","title":"Anisotropic convolutional networks for 3d semantic scene completion","venue":null,"work_id":"acccd566-5f26-41e1-be3b-5e9270b7bdc8","year":2020},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.122366Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:f1974b30ec16842e31bab96bae8da93dc194b5647f762e6476dc8542583ca426","observation_id":"0cf7f932-57e7-4279-8b65-bb4b069ccbb7","resolution":{"observed_at":"2026-08-06T14:48:21.214450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.193949Z","title":"Less is more: Reducing task and model complexity for 3d point cloud se- mantic segmentation","venue":null,"work_id":"38a49c9c-1e5f-4642-909a-b5c26217d5d8","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.127425Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:07ae34830bf6386a89599e10a198206dcdd4ec5a341888880f8cb1d47350e88b","observation_id":"b06967ea-77e2-4251-88ed-63c4d0b494b0","resolution":{"observed_at":"2026-08-06T14:48:21.198442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.178307Z","title":null,"venue":null,"work_id":"c1767ca4-5a7f-4b37-9412-c32175b26e14","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.133493Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:6018b9dfb06019cead5989e948548c3e89c0c354d7a88bfdf8a27cb3f2c157c7","observation_id":"10cb8cb9-d1d8-4cfc-a2fb-44b4cb1ccbfe","resolution":{"observed_at":"2026-08-06T14:48:21.182842Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01784","last_updated":"2022-10-08T03:42:10Z","snapshot_observed_at":"2026-08-07T16:45:51.835105Z","submitted_at":"2022-10-04T17:54:53Z","title":"COARSE3D: Class-Prototypes for Contrastive Learning in Weakly-Supervised 3D Point Cloud Segmentation","version":2},"cited_work":{"arxiv_id":"2210.01784","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.01784","snapshot_observed_at":"2026-08-06T14:48:19.799810Z","title":"COARSE3D: Class-Prototypes for Contrastive Learning in Weakly-Supervised 3D Point Cloud Segmentation","venue":"cs.CV","work_id":"2b1bde16-4bc4-416c-a933-6c122313c3f6","year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.138397Z"},"links":{"cited_paper":"/paper/2210.01784","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:91e0f64bdb3326dfe6d3e30450cb141ebe9204431ec4ae1e8877da17d36182b7","observation_id":"e096a70e-e043-48f7-b898-6876a0966ba5","resolution":{"observed_at":"2026-08-06T14:48:19.812752Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.161824Z","title":"Seeground: See and ground for zero-shot open-vocabulary 3d visual grounding","venue":null,"work_id":"f1e9b1e7-d92e-4362-b3f6-c568019da79b","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.144373Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:c2ce58c031d6cd8cc52877b19d9ae65c8d3e991c24a9d3e04f7f4e12ac1f2595","observation_id":"d6efdd0d-a5ee-45be-bfa3-0d8f37b909a6","resolution":{"observed_at":"2026-08-06T14:48:21.166961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.145803Z","title":"V oxformer: Sparse voxel transformer for camera- based 3d semantic scene completion","venue":null,"work_id":"b30fb0e5-5d86-4923-bf3c-880d3630453f","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.149532Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:255c6a8b191f289b68e27a5b4500746f3c4c8bdac2167180264e2ef8550570ae","observation_id":"1b6e996c-494b-4ed8-842a-31d65659f5ac","resolution":{"observed_at":"2026-08-06T14:48:21.151295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.131555Z","title":"Is your lidar placement optimized for 3d scene understanding? In Advances in Neural Information Process- ing Systems, pages 34980–35017, 2024","venue":null,"work_id":"155fb4e8-7797-4aec-9294-72886c4f53b5","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.154231Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:58abfdb96a91b3ff5f68d129825a17b5065df101242b64818626e9980d0af239","observation_id":"a055e9cb-dbb3-4a8d-b588-a284b637cc4e","resolution":{"observed_at":"2026-08-06T14:48:21.136223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T14:48:19.159031Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.159031Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:1272684c1413c6dbf6664c9b67d70184d24da7ed5b77b50585cc6eab8fe3e128","observation_id":"2dd372dd-77ec-49ab-a405-34cc0db63d04","resolution":{"observed_at":"2026-08-06T14:48:19.159031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.112753Z","title":"See and think: Disentangling semantic scene completion","venue":null,"work_id":"820bcc5c-875e-4e0b-9641-e31bce39512d","year":2018},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.163953Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:1af1706de162dd21ab6f0fff770ce0d8d1c0ea8ba5f10011fb8842c4d7017036","observation_id":"0ad422fd-e4c8-4304-80b7-897e8fc556bc","resolution":{"observed_at":"2026-08-06T14:48:21.118997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.090450Z","title":"Uniseg: A unified multi-modal li- dar segmentation network and the openpcseg codebase","venue":null,"work_id":"43e89268-61a9-41f6-969a-083822ecebc7","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.169083Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:9cae3bec850764371923dccde746d054828014f6d731aceef849f5d60e9286a9","observation_id":"792fd3a2-620a-49ac-b529-e5dc6e12f502","resolution":{"observed_at":"2026-08-06T14:48:21.097631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.065319Z","title":"Segment any point cloud sequences by distilling vision foundation models","venue":null,"work_id":"0c68b4fd-c587-48b3-ae5b-0b70f7d8bb79","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.174790Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:7f6758fadd2fe45983f70c9b07a8dae810c476ec1e5113a167eb79437e1e641a","observation_id":"11543c19-d0cf-4822-9d02-383a70f6113b","resolution":{"observed_at":"2026-08-06T14:48:21.077099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.047070Z","title":"Multi-space alignments towards universal lidar segmentation","venue":null,"work_id":"4df79a20-afd6-4c7a-aa98-5a8b672a215e","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.181248Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:8ca6dcc91169eb12b41b78b405e1433fd02c16ac602b5146f1350e1142d6e5d5","observation_id":"59e5396e-695b-48bc-9a6b-0f1056ccec82","resolution":{"observed_at":"2026-08-06T14:48:21.052710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.030281Z","title":"Self-supervised image- to-point distillation via semantically tolerant contrastive loss","venue":null,"work_id":"8bba6211-07ec-4603-b339-9fa67c45e679","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.185983Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:44ad9a541e89c8f3ada9f9f60d7f5f3abdc9c0110892732a537a1322c1ef82f4","observation_id":"b5d987d5-96c5-4b83-8c2c-435be8b9d47d","resolution":{"observed_at":"2026-08-06T14:48:21.035136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17791","last_updated":"2025-07-16T13:45:17Z","snapshot_observed_at":"2026-08-07T15:59:25.025205Z","submitted_at":"2025-04-24T17:59:59Z","title":"LiDPM: Rethinking Point Diffusion for Lidar Scene Completion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17791","snapshot_observed_at":"2026-08-06T14:48:19.192447Z","title":"Lidpm: Rethinking point diffusion for lidar scene completion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.192447Z"},"links":{"cited_paper":"/paper/2504.17791","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:bf8a7b37fefb83b95a83289a704ecc24c9ae3e4b99310776502324ca3d509eba","observation_id":"83212143-e7f4-436e-ac00-e405a2d376d0","resolution":{"observed_at":"2026-08-06T14:48:19.192447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.008392Z","title":"Occupancy networks: Learning 3d reconstruction in function space","venue":null,"work_id":"c40e77dd-9ca0-43f7-92b4-75ff9ff6bb3f","year":2019},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.198311Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:c9febf42a8a2062cb38a8fa944aecc7035809354b62a4c3781ff6054ba53495d","observation_id":"644f06ab-c4ff-4eec-9641-7c4e13beffe0","resolution":{"observed_at":"2026-08-06T14:48:21.015765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.988438Z","title":"Train till you drop: Towards stable and robust source-free unsupervised 3d do- main adaptation","venue":null,"work_id":"080507aa-e6c2-4d4d-bcda-b5b40c84ca73","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.205229Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:ba58d24f19e93d85f8851e27c8563d36d4679a5e8e52cd13ed292b4b40f92a11","observation_id":"07a804c5-e118-4dcc-8f35-a9e90e8e650b","resolution":{"observed_at":"2026-08-06T14:48:20.995407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.970814Z","title":"Tempo- ral consistent 3d lidar representation learning for semantic perception in autonomous driving","venue":null,"work_id":"eca7c27f-87fc-42c8-b344-7732ec9a733d","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.211377Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:0f9afa0d1903f6856b8c99e54f3d71f6e98259e62f7805019d5de330ace93bd4","observation_id":"85896637-3b88-47a5-95c5-96839c21edd9","resolution":{"observed_at":"2026-08-06T14:48:20.976184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.939834Z","title":"Deepsdf: Learning con- tinuous signed distance functions for shape representation","venue":null,"work_id":"b11336f0-7203-4bdb-b093-860121411b08","year":2019},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.216657Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:1def9a01279d5c336aed8f30787147126e4d685fa3bd1e397d4f41c47c25ccb8","observation_id":"64979861-db0d-4471-92e0-80a21500d5c1","resolution":{"observed_at":"2026-08-06T14:48:20.948206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.917470Z","title":"Convolutional occupancy networks","venue":null,"work_id":"38248a26-5734-40f0-837a-7429dd770f20","year":2020},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.221929Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:0d1c1feea0a589dc14f305d0774e970a7f7792d5f2ed9aefbe65bd8d26fd0aff","observation_id":"50e67148-6d86-4427-8ca8-793daf5d4d5b","resolution":{"observed_at":"2026-08-06T14:48:20.923906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.896307Z","title":"Learning to adapt sam for segmenting cross-domain point clouds","venue":null,"work_id":"fe16028a-9196-4af4-b2fc-128598f7ba27","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.226359Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:a84b77ead93f9d9d77baea05652ec4a74fe7f76bae6315c8c29043f8ac6de99b","observation_id":"25070796-d2f1-4981-8123-27579617ac65","resolution":{"observed_at":"2026-08-06T14:48:20.902685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.867468Z","title":"Using a waffle iron for automotive point cloud semantic segmenta- tion","venue":null,"work_id":"0f37ac05-72ae-491a-a520-b1634c09de8f","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.230315Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:4dd98a95d9b1e19af3dcb5e00b548b16a247b66b5546561ab452425aadebd571","observation_id":"fdf3b5d4-df3f-408f-833c-6da5eb5b6913","resolution":{"observed_at":"2026-08-06T14:48:20.874869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.845089Z","title":"Three pillars improving vision foundation model distillation for lidar","venue":null,"work_id":"9c271351-d482-4fa2-84ff-43ab670348f3","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.234767Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:f6f7bdad0606e7c4bb52ca247aa2b966f725b90757e4ee7862166554788eea5c","observation_id":"bfd562af-6518-4cf7-9a55-1859eae1b728","resolution":{"observed_at":"2026-08-06T14:48:20.853688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.817566Z","title":"Completing 3d object shape from one depth image","venue":null,"work_id":"3d2d4c4a-33f8-47fb-b1c5-51f0018cdaff","year":2015},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.242845Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:69c904d90d98b6795999600af978ae6d546b56575cd296052b7c016deeed017a","observation_id":"7b475e4d-5b7d-4e9a-b6be-aa7c3d549df6","resolution":{"observed_at":"2026-08-06T14:48:20.822388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.798331Z","title":"Lmscnet: Lightweight multiscale 3d se- mantic completion","venue":null,"work_id":"cbe7ed70-da6f-494b-9aa4-48b776f96081","year":2020},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.248937Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:f5de29a66bfc75d3ac5e013dcf65676dde475961d84bb0c970338e8c0a771eec","observation_id":"26823350-9d9f-4d52-80f2-d8a531565646","resolution":{"observed_at":"2026-08-06T14:48:20.803793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.753180Z","title":"You never get a second chance to make a good first impression: Seeding ac- tive learning for 3d semantic segmentation","venue":null,"work_id":"14878d0f-50a4-4c70-bc62-a95f446047f6","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.254094Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:60deb269afe36fafea3ce296fe87053d9fc67eabbf981cef9760dea4269d49a8","observation_id":"be3dcbb0-c447-4522-8ee2-5af72770f68e","resolution":{"observed_at":"2026-08-06T14:48:20.767542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15797","last_updated":"2024-07-22T16:59:49Z","snapshot_observed_at":"2026-07-06T18:50:09.295399Z","submitted_at":"2024-07-22T16:59:49Z","title":"MILAN: Milli-Annotations for Lidar Semantic Segmentation","version":1},"cited_work":{"arxiv_id":"2407.15797","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.15797","snapshot_observed_at":"2026-08-06T14:48:19.710122Z","title":"MILAN: Milli-Annotations for Lidar Semantic Segmentation","venue":"cs.CV","work_id":"6204e6fb-982b-45ee-8e5a-9022f0a3b1dc","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.258450Z"},"links":{"cited_paper":"/paper/2407.15797","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:597a2308048d4f3ffea8c1eab3992a730334a76c92753770aa023e1a808f96b8","observation_id":"72359adc-1747-4998-8c40-ec07266ca642","resolution":{"observed_at":"2026-08-06T14:48:19.716852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.725299Z","title":"Image-to-lidar self-supervised distillation for autonomous driving data","venue":null,"work_id":"8e41a523-7e27-4ffe-ac10-6b34d03150bf","year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.263547Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:224f15dc130b6b525129547a571b94736a67e765509b7e4fa231eb86e355c09c","observation_id":"bcf17259-f762-4d7e-99fa-026802ff431d","resolution":{"observed_at":"2026-08-06T14:48:20.733594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.692726Z","title":"Bevcontrast: Self-supervision in bev space for automotive lidar point clouds","venue":null,"work_id":"a86e352b-2f35-4e27-90af-df90f26d2da5","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.267837Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:38f7821d0ebbe2a467f144b11f111b614aca3ddb042e9f492b8ad5192913bb29","observation_id":"c8eae49d-f06a-4a88-b6d5-6ef09e34a3cb","resolution":{"observed_at":"2026-08-06T14:48:20.699848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.13203","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:19.672871Z","title":"Clustering is back: Reaching state-of-the-art lidar instance segmentation without training","venue":null,"work_id":"0f37d33d-117e-42ed-835b-431b58a33329","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.272278Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:acfb582a0fcf50aa658de7d20ef08e3ed75f25c48d8fad51dacf349313e084df","observation_id":"c7d2f91c-4843-4194-b72a-5f584c023ff4","resolution":{"observed_at":"2026-08-06T14:48:19.684419Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.671231Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"c12820b0-a0c1-45fd-a09e-b85f8a739da4","year":2012},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.276992Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:0b6a00c5558e04f60f7d83d0d2f16a313c1f38f365dc212f1076ac605496de73","observation_id":"c5f576db-4f2d-4378-b2a9-47e688ec787e","resolution":{"observed_at":"2026-08-06T14:48:20.678067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.646370Z","title":"Chang, Manolis Savva, and Thomas Funkhouser","venue":null,"work_id":"c3aaba30-9385-42f2-8830-9c3a3eacb51a","year":2017},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.284063Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:d45b37d4ac14fa45d82efeb6fac48cd647010cbfb66c5f6076ce491c9b7374ab","observation_id":"87c52b9c-6b80-4816-b246-9c3145d7658e","resolution":{"observed_at":"2026-08-06T14:48:20.652748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.620407Z","title":"Searching efficient 3d archi- tectures with sparse point-voxel convolution","venue":null,"work_id":"bc1660b2-7054-4621-ac5e-8a3e46441809","year":2020},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.291549Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:0957a3e1d05f1319fed77d904aadf1fff712afbd958636ba698ec3e52cca712f","observation_id":"d3e42746-52e1-40f1-b7fc-ef249fbfb8dd","resolution":{"observed_at":"2026-08-06T14:48:20.626933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.552851Z","title":"Semantic scene completion via integrating instances and scene in-the-loop","venue":null,"work_id":"e6b57fa7-c04e-41f2-9390-43731b4ac051","year":2021},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.299327Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:cbbd25f484739cba28bb00aacec5b12d864744f33d42552c6f24fdbdd8fc537b","observation_id":"114c0670-4bfe-4f36-abb8-d4da5d101e27","resolution":{"observed_at":"2026-08-06T14:48:20.597249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.503738Z","title":"Meta- rangeseg: Lidar sequence semantic segmentation using mul- tiple feature aggregation","venue":null,"work_id":"79191aa6-0e86-4df0-93c7-d583c9995845","year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.304727Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:5bd5a0d99c125f2c9eb14a9433d475ff86ba6f3ad6cb70c9f52ad1bc50f92124","observation_id":"0109fb70-9406-47ef-aaa2-374768a1e035","resolution":{"observed_at":"2026-08-06T14:48:20.520209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.482068Z","title":"Lidar2map: In defense of lidar-based semantic map construction using online camera distillation","venue":null,"work_id":"a18b829b-09b9-4aae-8599-94f1f64f11fd","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.309404Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:5b22d9515d8296481f4ec88372da5e0efaeacf19ad8996ef9321add1cea761ce","observation_id":"d07f0528-0f48-4691-8c60-61ac78934649","resolution":{"observed_at":"2026-08-06T14:48:20.486492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.462239Z","title":"Not all voxels are equal: Hardness-aware semantic scene completion with self- distillation","venue":null,"work_id":"3aaeb0ae-cc41-4552-901d-480050ebda5e","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.313669Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:c47afdcf491d8ab394e96401f0395bae8c02d592864307c720c8d3dcab3a8ddb","observation_id":"eb785623-7923-4d15-b271-bfbbc406607e","resolution":{"observed_at":"2026-08-06T14:48:20.470184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18026","last_updated":"2024-09-26T16:33:16Z","snapshot_observed_at":"2026-07-06T19:22:54.212921Z","submitted_at":"2024-09-26T16:33:16Z","title":"ReliOcc: Towards Reliable Semantic Occupancy Prediction via Uncertainty Learning","version":1},"cited_work":{"arxiv_id":"2409.18026","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.18026","snapshot_observed_at":"2026-08-06T14:48:19.499026Z","title":"ReliOcc: Towards Reliable Semantic Occupancy Prediction via Uncertainty Learning","venue":"cs.CV","work_id":"3e73a609-c08b-4f55-bfbe-29ddcfd092c3","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.318184Z"},"links":{"cited_paper":"/paper/2409.18026","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:794349ee0d216d5c164358d2539604304c96d2ef441813c4901ccec540b211d0","observation_id":"8159cfa2-9b09-4bf9-b79f-92583870b381","resolution":{"observed_at":"2026-08-06T14:48:19.509185Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.436536Z","title":"Pointlora: Low-rank adaptation with to- ken selection for point cloud learning","venue":null,"work_id":"6d4de955-90a9-4c26-ab5e-e1a206ad2196","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.322955Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:1fa13e5b893d8908043753b0d57970a1716f69ab79cbba1e882f7b436d210a63","observation_id":"1e6a1439-0f40-495b-8a84-024d8857be14","resolution":{"observed_at":"2026-08-06T14:48:20.442320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.417281Z","title":"Ffnet: Frequency fu- sion network for semantic scene completion","venue":null,"work_id":"719ca83e-3e13-42dd-977f-bd8576c343fc","year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.327492Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:dfd1f8873eae691a45a300199bd819a8871813edf1e96605ea0d5c18abae2c12","observation_id":"f7ba693d-25f8-45ef-b9e8-9e544f9be67b","resolution":{"observed_at":"2026-08-06T14:48:20.424348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.392888Z","title":"Nuc-net: Non-uniform cylindrical partition network for ef- ficient lidar semantic segmentation","venue":null,"work_id":"2662f974-a1a2-403e-80dd-798e32ba3265","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.332483Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:a772e7f1f5032774b07b1dbed5d9985f9af99f4a0bed8eb31b2e458fc4cd1e2b","observation_id":"19e54788-c4d2-4e79-b2bf-c1d50436950d","resolution":{"observed_at":"2026-08-06T14:48:20.399460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.363524Z","title":"H2gformer: Horizontal-to-global voxel transformer for 3d semantic scene completion","venue":null,"work_id":"d2987bb6-ed3d-4d83-8e9c-ceaec7020efc","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.336862Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:33ad25d9f8b5e64f66aad9374ae2892f7b105196d5797f4066c5ea1f9a3c17c2","observation_id":"3baad1df-a21e-4be6-88fc-67acc4a52a25","resolution":{"observed_at":"2026-08-06T14:48:20.379264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.336673Z","title":"Scpnet: Se- mantic scene completion on point cloud","venue":null,"work_id":"7ec492b5-9c66-43cf-9ed6-7176d59c9b0a","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.342829Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:efbc2da76b68ae76fa29f68dc9a4fa8d1f48a106c5c8d1462613e8624de2736c","observation_id":"d047f036-fe1a-49de-b1be-4e073071369f","resolution":{"observed_at":"2026-08-06T14:48:20.347226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04003","last_updated":"2025-01-07T18:59:55Z","snapshot_observed_at":"2026-08-08T11:04:47.414047Z","submitted_at":"2025-01-07T18:59:55Z","title":"Are VLMs Ready for Autonomous Driving? An Empirical Study from the Reliability, Data, and Metric Perspectives","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04003","snapshot_observed_at":"2026-08-06T14:48:19.348528Z","title":"Are vlms ready for autonomous driving? an empiri- cal study from the reliability, data, and metric perspectives","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.348528Z"},"links":{"cited_paper":"/paper/2501.04003","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:3fc05d092b5a62601ebb8de9da882f516542cab3a22deb723a003016bcd64eda","observation_id":"3d08c49b-b6a6-4b7a-b594-9b0289d2b4c6","resolution":{"observed_at":"2026-08-06T14:48:19.348528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.310485Z","title":"Benchmarking and im- proving bird’s eye view perception robustness in autonomous driving","venue":null,"work_id":"5263aba8-ed6f-4ed2-956f-d2f4b4a60417","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.353138Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:fe766fa5d20e9b478a5cfb8edf10092dc937805d5173c4aa27b61ba1b10fa6cf","observation_id":"1bf1c88d-43d5-4547-8003-79c651f24c48","resolution":{"observed_at":"2026-08-06T14:48:20.324028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.289069Z","title":"4d contrastive superflows are dense 3d representation learners","venue":null,"work_id":"8913b95d-a5a4-422f-8699-599e8dcc0f43","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.357583Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:f520bd5ef8bc48f729299e71794a6644221ee0659623578dafd1e9bb17805866","observation_id":"684de91d-5b50-44bb-aaa9-640495817376","resolution":{"observed_at":"2026-08-06T14:48:20.296154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.252499Z","title":"Frnet: Frustum-range networks for scalable lidar segmen- tation","venue":null,"work_id":"9a4a8461-ab34-4227-bcb2-b784ae473fc6","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.362435Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:56a58df1506c812720a2745e4ceb710d690019e242be8219d966d72ad9546510","observation_id":"dd5c0652-01ec-4001-a886-65353ac29641","resolution":{"observed_at":"2026-08-06T14:48:20.265162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.219458Z","title":"Limoe: Mixture of lidar represen- tation learners from automotive scenes","venue":null,"work_id":"1a566611-aae7-4cd1-a4b5-2ae2ff487c7e","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.367938Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:07664da6fded7bbae39e8486d13859e17e19f71023f1b777f9577fb713c3af3e","observation_id":"a3dee4f7-c44e-469b-b00e-1fb1c0e795a2","resolution":{"observed_at":"2026-08-06T14:48:20.231202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.182618Z","title":"Bi-ssc: Geometric-semantic bidirectional fusion for camera-based 3d semantic scene completion","venue":null,"work_id":"7c89d657-8dc9-4877-a436-c13902c3441c","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.372419Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:b4b6f6cdad3ff7df8a8cf141213dadc48181004442ae9c57bd421a01a24c1a14","observation_id":"3bfd38f7-36ce-4547-8f3c-b9b33bbc0ba3","resolution":{"observed_at":"2026-08-06T14:48:20.189367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.153946Z","title":"Sparse single sweep lidar point cloud segmentation via learning contextual shape priors from scene completion","venue":null,"work_id":"0192bb09-9fbd-4ace-9819-096bc69fc671","year":2021},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.377488Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:a9eaaa2eb12fad44db64c40beba5b76b650eb6484ea678957ee73f2dcd777895","observation_id":"04286f8d-8311-434c-a6ae-70835e133402","resolution":{"observed_at":"2026-08-06T14:48:20.161878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.130233Z","title":"2dpass: 2d priors assisted semantic segmentation on lidar point clouds","venue":null,"work_id":"7f5f2581-8481-4662-95b7-70bf288529c6","year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.381511Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:6e53c45352ef071f3af5080ead1c7f6488e2305b2f929a74ad394c7bb9f5907c","observation_id":"6156eb08-6432-4499-a00d-17a6406cc98a","resolution":{"observed_at":"2026-08-06T14:48:20.136522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.089005Z","title":"Ndc-scene: Boost monocular 3d semantic scene completion in normalized de- vice coordinates space","venue":null,"work_id":"7ea02e2c-6b8e-446e-a52e-21c6acac75ba","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.389102Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:c1f4574d18fa8ca2e9e26f31c587e7e0cb06045f26be618296d3d4dc4f9e81a4","observation_id":"97608196-40eb-4d9c-bcf7-a586eb25c03a","resolution":{"observed_at":"2026-08-06T14:48:20.109252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.066264Z","title":"Efficient semantic scene comple- tion network with spatial group convolution","venue":null,"work_id":"581052ec-09e4-4e99-8291-4c1821f6b648","year":2018},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.397651Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:4fa200943d0590eaeb2aa88c6bdf9b55b360e8003e46373794a06b8aaead2095","observation_id":"6950cb2a-f3b4-4333-a99b-4937c3e46944","resolution":{"observed_at":"2026-08-06T14:48:20.075724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.028424Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occu- pancy prediction","venue":null,"work_id":"c25e07a4-c0e1-4338-be15-9b1f4e082f78","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.405981Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:6ca727cb3c8bb9a0885b0106769b05cfe0195d258faf9864256efb6ed7ffd7e9","observation_id":"b34976a5-1c1a-4913-ab21-6f0ac57abfe9","resolution":{"observed_at":"2026-08-06T14:48:20.039856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.000227Z","title":"Monoocc: Digging into monocular semantic oc- cupancy prediction","venue":null,"work_id":"eb3e0d9a-baf0-417d-85e9-ff013d767445","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.411266Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:2b1e50722610c5ee804cca00259003b57adb65f50bb3c09afd29c39984071710","observation_id":"a6bf403b-d13a-4658-b8ec-21793f6403aa","resolution":{"observed_at":"2026-08-06T14:48:20.012032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks"},"reference_resolution":{"displayed":95,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":5,"verified_fuzzy":70},"total_outbound_references":95},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 95 of 95 outbound references and 0 inbound Pith citation observations for arXiv:2507.17661."}