{"as_of":"2026-08-13T16:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e52a291bd3016dcd1e18bee5b66d695bb91eb7d2964863a651a0ed4ed957afe5","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T15:32:47.491471Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.14169/citation-record","integrity":"/paper/2411.14169/integrity","json":"/paper/2411.14169/citation-record.json","paper":"/paper/2411.14169"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.318014Z","title":"Monoscene: Monocular 3d semantic scene completion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.318014Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:a6f94c3883e2223e80b85108fcbbd8e0f9a35a1199f4851b631e27d6214bfd35","observation_id":"3504bf93-38b5-4faa-9183-f56ef013a858","resolution":{"observed_at":"2026-08-12T15:32:47.318014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.322650Z","title":"Openoccupancy: A large scale benchmark for surrounding semantic occupancy perception,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.322650Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:bf79804ebc3e644dc811b02930b1796aacb9a7ef0151a8d865650be381b604d1","observation_id":"6bd4257c-386e-4249-857c-82b4ac9de964","resolution":{"observed_at":"2026-08-12T15:32:47.322650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.119538Z","title":"V oxformer: Sparse voxel transformer for camera- based 3d semantic scene completion,","venue":null,"work_id":"e814ec2e-0f4f-4eff-9f6e-a19f52cd2921","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.326448Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:ba9144b342c529c6fc6eb02bc7b19611de712d53da514112bc3b45ea2828cc6e","observation_id":"a42b20e5-74db-4914-b20a-29709dde10df","resolution":{"observed_at":"2026-08-12T15:32:48.123309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.108014Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":"8cb3d5f5-8456-4683-a418-17e1e959a370","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.330485Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:7e47bb09db5c4b3df812457c46309406afc4162544b5091ee2c8c956d47d03bc","observation_id":"e97cf924-ae70-4cf7-8a9c-02e156cd4401","resolution":{"observed_at":"2026-08-12T15:32:48.112358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.095506Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":"070082a8-35e9-4571-8bab-8e7f5e192eb0","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.334173Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:c046403653f867657f383e2631a9d8379c2dc66da89f00d52cf6720ea83a9766","observation_id":"d1b76671-acec-4f60-ab64-08d61c12f981","resolution":{"observed_at":"2026-08-12T15:32:48.100043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06994","last_updated":"2024-01-13T06:43:25Z","snapshot_observed_at":"2026-08-13T04:43:34.092426Z","submitted_at":"2024-01-13T06:43:25Z","title":"UniVision: A Unified Framework for Vision-Centric 3D Perception","version":1},"cited_work":{"arxiv_id":"2401.06994","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.06994","snapshot_observed_at":"2026-08-12T15:32:47.653971Z","title":"UniVision: A Unified Framework for Vision-Centric 3D Perception","venue":"cs.CV","work_id":"c52b3abe-ff01-4064-98ed-aa95139eedce","year":2024},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.338048Z"},"links":{"cited_paper":"/paper/2401.06994","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:378cf3425c2647ac622e86c317c1c7fe2594dbed32794757e05b7cf76f1c751b","observation_id":"b0540709-bc74-4511-89ed-23c7b9fc5441","resolution":{"observed_at":"2026-08-12T15:32:47.657378Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.080698Z","title":"Selfocc: Self- supervised vision-based 3d occupancy prediction,","venue":null,"work_id":"754fc44d-761b-4942-b6cd-a49e93632691","year":2024},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.342408Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:d6545e49d2301b87f30f6e9cfd66f232454b0fce73b290e5c6c9426f3b6ed6e9","observation_id":"77361583-cf10-4faf-af81-19a7aea67e05","resolution":{"observed_at":"2026-08-12T15:32:48.085478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.066804Z","title":"Point cloud forecasting as a proxy for 4d occupancy forecasting,","venue":null,"work_id":"1fd41da0-d9fb-4eb9-8cfb-f0ac7b66b79f","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.346145Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:492ee4346f0d14cbe7b34548f6426ff04146a9f7a3f3d88c332c8d11357ec5d5","observation_id":"8b4704f1-e30c-4460-97cb-1b6010a83457","resolution":{"observed_at":"2026-08-12T15:32:48.071179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.052755Z","title":"Fiery: Future instance prediction in bird’s- eye view from surround monocular cameras,","venue":null,"work_id":"0080d7dd-3353-4946-b6e2-7342c6f385e5","year":2021},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.350850Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:f7b5fd4373f51b77244deb83174171a659f4b169ac79d711a0bca693b32b888a","observation_id":"53c91146-c23d-489b-a9bb-e9bd5225c775","resolution":{"observed_at":"2026-08-12T15:32:48.056962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.039400Z","title":"Stretchbev: Stretching future instance prediction spatially and temporally,","venue":null,"work_id":"981080db-fef4-4529-9524-38f0ca19f66d","year":2022},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.355081Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:4f4809433d5f56816dc0bfefc194cf07ce9142d90a0cfb61eb11f6a937b6c8f8","observation_id":"8e2e5854-e2ec-43f4-bb7a-75e9b9811088","resolution":{"observed_at":"2026-08-12T15:32:48.043986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.09743","last_updated":"2022-05-19T17:55:35Z","snapshot_observed_at":"2026-08-13T15:40:32.875315Z","submitted_at":"2022-05-19T17:55:35Z","title":"BEVerse: Unified Perception and Prediction in Birds-Eye-View for Vision-Centric Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.09743","snapshot_observed_at":"2026-08-12T15:32:47.359044Z","title":"Beverse: Unified perception and prediction in birds-eye-view for vision-centric autonomous driving,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.359044Z"},"links":{"cited_paper":"/paper/2205.09743","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:f7c3897f1743b73857befcae223ce64323b9a0a16d398c48a61dfd266a13ad7e","observation_id":"e1c0e668-104f-4bf5-869b-c1c0e7c34e8f","resolution":{"observed_at":"2026-08-12T15:32:47.359044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.025515Z","title":"Powerbev: a powerful yet lightweight framework for instance pre- diction in bird’s-eye view,","venue":null,"work_id":"148e781a-2fa6-4eab-aacd-f3fcc5d24831","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.364167Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:cacd38019567a610962b03d3e8435782e7957632332ca6f6884796096ce090ee","observation_id":"bbf1f3a3-71fa-4ac5-9ede-45f77fd713c0","resolution":{"observed_at":"2026-08-12T15:32:48.030298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.013541Z","title":"Cam4docc: Benchmark for camera-only 4d occupancy forecasting in autonomous driving applications,","venue":null,"work_id":"04fae88c-2d2f-49e2-a682-828f6da4f083","year":2024},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.367421Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:728c09ea4f2e63d58e2b4a436211967fd7e5287f4e4a11970a0ff8d9b2d08bbb","observation_id":"b74138f2-3edb-4cfe-bf88-651f0346d006","resolution":{"observed_at":"2026-08-12T15:32:48.017388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11239","last_updated":"2024-09-10T13:28:58Z","snapshot_observed_at":"2026-08-13T05:47:37.913505Z","submitted_at":"2023-10-17T13:08:24Z","title":"LiDAR-based 4D Occupancy Completion and Forecasting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11239","snapshot_observed_at":"2026-08-12T15:32:47.371082Z","title":"Lidar- based 4d occupancy completion and forecasting,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.371082Z"},"links":{"cited_paper":"/paper/2310.11239","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:77d0a0b789e5f40bf4ec199ba7e92d3201b37bacba60866995fc183a5b8f0cd0","observation_id":"4edcee08-3033-489e-a079-68d376116661","resolution":{"observed_at":"2026-08-12T15:32:47.371082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.374735Z","title":"Surroundocc: Multi-camera 3d occupancy prediction for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.374735Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:70fceafbd4ed2819fc6fb4c9d6108d859b25fe358aa003691894bc55c985a60e","observation_id":"c9f0c4f7-6362-4880-9d41-c6d0d83a38fa","resolution":{"observed_at":"2026-08-12T15:32:47.374735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09117","last_updated":"2023-06-15T13:23:57Z","snapshot_observed_at":"2026-08-13T11:16:03.160755Z","submitted_at":"2023-06-15T13:23:57Z","title":"UniOcc: Unifying Vision-Centric 3D Occupancy Prediction with Geometric and Semantic Rendering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09117","snapshot_observed_at":"2026-08-12T15:32:47.378279Z","title":"Uniocc: Unifying vision-centric 3d occupancy prediction with geometric and semantic rendering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.378279Z"},"links":{"cited_paper":"/paper/2306.09117","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:7b843e450bc331a6d5df8d37a2e1b3bb4a14bbfae198dc9198bb06f24ca82cb8","observation_id":"6be650c7-27bf-4108-add8-3a0acea9d373","resolution":{"observed_at":"2026-08-12T15:32:47.378279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18140","last_updated":"2024-02-28T08:03:34Z","snapshot_observed_at":"2026-08-13T09:06:10.260581Z","submitted_at":"2024-02-28T08:03:34Z","title":"OccTransformer: Improving BEVFormer for 3D camera-only occupancy prediction","version":1},"cited_work":{"arxiv_id":"2402.18140","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.18140","snapshot_observed_at":"2026-08-12T15:32:47.605537Z","title":"OccTransformer: Improving BEVFormer for 3D camera-only occupancy prediction","venue":"cs.CV","work_id":"efbd921c-2fb9-40ea-b4ee-c0dfed841a8e","year":2024},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.382029Z"},"links":{"cited_paper":"/paper/2402.18140","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:e05183e9985dd5bf5c43700f93e3c47b5680944aca7d166a0dabbecb812e96ff","observation_id":"66315e7f-0155-4619-ae25-e7f3bae0a108","resolution":{"observed_at":"2026-08-12T15:32:47.609983Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.386459Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.386459Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:bf6ecbd8b88d58d9229796b33f6dc08c3815efbc7f2252043c51a8a97ed57471","observation_id":"b9c06948-281d-401c-ba0a-d4f721221958","resolution":{"observed_at":"2026-08-12T15:32:47.386459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.983605Z","title":"Lyft level 5 perception dataset 2020,","venue":null,"work_id":"8fb51693-8372-4e89-9269-8c3ca802b362","year":2020},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.390510Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:74b97673edb3ba12a7aea580ea736ad115c96a1a9a2e218a8b9069a8958106db","observation_id":"9dd517f9-b526-46f2-a5ab-a6da9b7d8b76","resolution":{"observed_at":"2026-08-12T15:32:47.987604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.394461Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.394461Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:ebde00f3562afd571783866554b51b3e573f7f2e7b22d627d8ba5d1797969366","observation_id":"0ce5f56c-b18c-478f-964a-d3951c1ee42f","resolution":{"observed_at":"2026-08-12T15:32:47.394461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.398188Z","title":"Occ3d: A large-scale 3d occupancy prediction benchmark for autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.398188Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:23262564a50fbf7dcd83afa59e8f98457df0ce1ecc2196702f34c890420ab3cc","observation_id":"8d3ba5ad-a8a3-4016-ab42-40125af21231","resolution":{"observed_at":"2026-08-12T15:32:47.398188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.951715Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers,","venue":null,"work_id":"249e28a0-b39b-456b-b7b3-482c125735bf","year":2022},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.402619Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:eae94557300ef5435b8ef1db9e73def7a54cf0d0f239b8f1586dff35f8c547e5","observation_id":"2e099d6b-5456-43dc-933d-a1bebf5da3ac","resolution":{"observed_at":"2026-08-12T15:32:47.956527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.940545Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detection,","venue":null,"work_id":"e35fcbfb-e0bb-4b62-b71f-bd3640bca8ee","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.407902Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:c8547f1a0bed026dc3e5bb0f7cfc4aeb88c4706dd7054e7411cac6993dbff42e","observation_id":"1438c508-9c1f-4bf2-8518-79a94c2cbf3d","resolution":{"observed_at":"2026-08-12T15:32:47.944050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.930167Z","title":"Bevfusion: Multi-task multi-sensor fusion with unified bird’s- eye view representation,","venue":null,"work_id":"fbd148d3-88ea-4339-8370-3f4142f7f0d7","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.412190Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:e26eb281af2b89a432ee80769097da7a8e39f0a3b7d80a4bf17eaecaa7b473e3","observation_id":"91069a47-1937-4c5c-a039-07e5493ee7dc","resolution":{"observed_at":"2026-08-12T15:32:47.933604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.918332Z","title":"Multi-modal hierarchical transformer for occupancy flow field prediction in autonomous driving,","venue":null,"work_id":"e1d5b18e-e961-4a8d-9b50-1d5a43b8087c","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.416769Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:5241f8bad37d72ed4993c651c9552739e5fc573773deaee171b7f44a0995d82d","observation_id":"a7de4b5e-c3c7-4956-8e3f-adebe2f85b2f","resolution":{"observed_at":"2026-08-12T15:32:47.922546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.420875Z","title":"Occupancy flow fields for motion forecasting in autonomous driving,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.420875Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:4cfe52a861e069a6c91f81cc59b55f5507ca39e26d75e55053c4c98a2feefe5e","observation_id":"9396295c-4231-4b10-a59f-8816df6d87ab","resolution":{"observed_at":"2026-08-12T15:32:47.420875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.895381Z","title":"Motionnet: Joint perception and motion prediction for autonomous driving based on bird’s eye view maps,","venue":null,"work_id":"f0fef657-1b04-45a9-9ab6-efac7692b7e0","year":2020},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.425380Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:7d0d62e9521bff86fa97f61806b48b700b04fe644563f8e6c906ae0e59d0aab4","observation_id":"309f71fe-fbb8-441d-92b4-342648238963","resolution":{"observed_at":"2026-08-12T15:32:47.899887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.881833Z","title":"Mp3: A unified model to map, perceive, predict and plan,","venue":null,"work_id":"d74ad28c-90c8-40b0-8125-f88ede250c16","year":2021},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.429804Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:8c0d2ca41300fc8638855c9325bbaefc0fb9c3e46dc508d1d5c4e35f2fbee036","observation_id":"3309eb1d-7308-45fb-b653-53c5beacea6b","resolution":{"observed_at":"2026-08-12T15:32:47.886455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.868168Z","title":"Monet: Motion-based point cloud prediction network,","venue":null,"work_id":"bd92545f-863c-4725-8c99-d77ceba9dda6","year":2021},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.434210Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:746be8876d517ca64f56cb3c365bc72f38dcc9ac4e16114be72796cec716c52b","observation_id":"2be51fe1-df04-4eb8-bfa8-ff16d7275de9","resolution":{"observed_at":"2026-08-12T15:32:47.872813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.740202Z","title":"Pcpnet: An efficient and semantic-enhanced transformer network for point cloud prediction,","venue":null,"work_id":"f0da1747-990b-4cc9-8a70-ce510d9e6841","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.438514Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:f9b81f1d5bf20baffad658e75bafa99c7f0b5978931d42bcc0e89bc170feefe1","observation_id":"e5e63fe6-adb0-44fd-8092-04ecff60f448","resolution":{"observed_at":"2026-08-12T15:32:47.859210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17399","last_updated":"2024-01-30T19:31:54Z","snapshot_observed_at":"2026-08-13T09:47:41.864840Z","submitted_at":"2024-01-30T19:31:54Z","title":"ATPPNet: Attention based Temporal Point cloud Prediction Network","version":1},"cited_work":{"arxiv_id":"2401.17399","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.17399","snapshot_observed_at":"2026-08-12T15:32:47.583720Z","title":"ATPPNet: Attention based Temporal Point cloud Prediction Network","venue":"cs.RO","work_id":"1b08a39c-c5a9-45a3-a862-de5e27cd8407","year":2024},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.442619Z"},"links":{"cited_paper":"/paper/2401.17399","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:e3b253dc1135549637aa8c9ef70790b58ad87e500c7a1657b87af3fddc58fd2e","observation_id":"3d4e9868-c702-4fc8-b80d-9d6799dd1021","resolution":{"observed_at":"2026-08-12T15:32:47.590738Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.728064Z","title":"Self-supervised point cloud prediction using 3d spatio-temporal convolutional net- works,","venue":null,"work_id":"2f0ce0ec-124a-4c0f-a234-f319e7f1b3a6","year":2022},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.447238Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:1111374c6ecbba6dbeadfd3e14dc92f04b5ac1b18dfaad104a2128ca4e2b8b44","observation_id":"e15a6c4d-681f-469a-bb1b-4547c962e703","resolution":{"observed_at":"2026-08-12T15:32:47.732220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.08287","last_updated":"2019-11-24T12:26:29Z","snapshot_observed_at":"2026-08-12T10:08:01.470642Z","submitted_at":"2019-10-18T07:21:37Z","title":"PointRNN: Point Recurrent Neural Network for Moving Point Cloud Processing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.08287","snapshot_observed_at":"2026-08-12T15:32:47.451190Z","title":"Pointrnn: Point recurrent neural network for moving point cloud processing,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.451190Z"},"links":{"cited_paper":"/paper/1910.08287","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:c263456c93bfe9e19ca66b6f0fc3db9b5e9a3772e63f70799d06a58d04967044","observation_id":"6b3320ad-339b-43cf-bd53-93e5d60afe05","resolution":{"observed_at":"2026-08-12T15:32:47.451190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16038","last_updated":"2023-11-27T17:59:41Z","snapshot_observed_at":"2026-08-13T05:16:48.939867Z","submitted_at":"2023-11-27T17:59:41Z","title":"OccWorld: Learning a 3D Occupancy World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16038","snapshot_observed_at":"2026-08-12T15:32:47.455530Z","title":"Occworld: Learning a 3d occupancy world model for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.455530Z"},"links":{"cited_paper":"/paper/2311.16038","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:9839497a32c7ebd5715a7c6a8ef0282c1e1e9a784b038eb381830b267130f322","observation_id":"aa78ec5e-3509-45c8-9679-c53bdeccfcd4","resolution":{"observed_at":"2026-08-12T15:32:47.455530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20337","last_updated":"2024-05-30T17:59:42Z","snapshot_observed_at":"2026-08-12T23:53:52.505475Z","submitted_at":"2024-05-30T17:59:42Z","title":"OccSora: 4D Occupancy Generation Models as World Simulators for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20337","snapshot_observed_at":"2026-08-12T15:32:47.459743Z","title":"Occsora: 4d occupancy generation models as world simulators for autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.459743Z"},"links":{"cited_paper":"/paper/2405.20337","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:3447b3f6e646dcec507f4c55ebb724bc8fc4fddca09ba337ea81c2ca61f7afcc","observation_id":"6277ad01-75d3-4762-83df-c8e66b907c11","resolution":{"observed_at":"2026-08-12T15:32:47.459743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.716998Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unprojecting to 3d,","venue":null,"work_id":"7b72aa43-7131-4ad9-849f-d5691fb55dae","year":2020},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.464171Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:c4f7b75a197914aef1a78fa983885594d41ecd97ef679bbf64977d117558edd2","observation_id":"23507d51-4c78-4669-ac56-b92ab23c1637","resolution":{"observed_at":"2026-08-12T15:32:47.720794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.468292Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.468292Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:ce65f0e3267cc83cdba3f977712f7352b2a3ca16bbbd8fd75445f652ee4effc8","observation_id":"3b403d24-ca52-4fd1-8004-595c1856d252","resolution":{"observed_at":"2026-08-12T15:32:47.468292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.696472Z","title":"Video panoptic seg- mentation,","venue":null,"work_id":"25f7778a-7963-45eb-8372-08fc2f9abb2c","year":2020},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.472813Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:9649636d72e6ef7d3741fd12231862aee9a00bc87dad3bd85451ed8d5d57faf7","observation_id":"bcc8d575-b145-44a5-8a69-b359c95c60f7","resolution":{"observed_at":"2026-08-12T15:32:47.700371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.685823Z","title":"Self-training with noisy student improves imagenet classification,","venue":null,"work_id":"1fa43315-7426-471b-8b3f-b5bec44b0f4d","year":2020},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.477119Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:be4f09d13fec3b7fce80e9f4a3f9389dfc0ad27550041a546a52cb70e085788a","observation_id":"bee717ee-5639-41ce-a2e8-8f457fb5954d","resolution":{"observed_at":"2026-08-12T15:32:47.689419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-12T15:32:47.482119Z","title":"Adam: A method for stochastic optimiza- tion,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.482119Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:b20aae29c9828b5ebcd888948f498538b993e50ccd74e986ffa484b2d321c981","observation_id":"3604dc8e-7046-46b0-8f12-250a9da37077","resolution":{"observed_at":"2026-08-12T15:32:47.482119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.674071Z","title":"IV of the main text","venue":null,"work_id":"caea28a7-2eb7-435a-9953-9999c1af0839","year":null},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.486496Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:1ede576610f7cdaef2477b20efa0ab20473fba2661fb42ab632aa4962a12c5fb","observation_id":"b39d30bf-d186-46b1-936a-298a45e79380","resolution":{"observed_at":"2026-08-12T15:32:47.677676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.664139Z","title":"As shown in Fig","venue":null,"work_id":"b528a579-76a2-49bf-abcb-61bd45dbacbe","year":null},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.491471Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:6212cc83c5337675a74ef8516b0ebed2970f8a2d62e6a57258ae56a51a22e024","observation_id":"5b78f164-4085-4379-8a3e-8d8addb40139","resolution":{"observed_at":"2026-08-12T15:32:47.667313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T15:25:12.702363Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":3,"verified_fuzzy":24},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2411.14169."}