{"as_of":"2026-08-05T10:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:af1a30e360d990ba279aa0c8818b1e19d0db5b387006087f629875d04ba15062","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T00:42:18.946960Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.26165/citation-record","integrity":"/paper/2607.26165/integrity","json":"/paper/2607.26165/citation-record.json","paper":"/paper/2607.26165"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:12.340325Z","title":"4d- former: Multimodal4dpanopticsegmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:12.340325Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:552ffce6a160e3819e9d0fa4c7e456d18347dd5f0f43ff50837e52dbfd98eb34","observation_id":"e7ccd08f-aff5-42c9-a71d-308baea03215","resolution":{"observed_at":"2026-08-01T00:42:12.340325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:12.527156Z","title":"Fantrack: 3d multi- object tracking with feature association network","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:12.527156Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:8969d83f98fd1b8367a11539430a2f510a79c0b2e1ce267d9f921a29a4ec653d","observation_id":"104618e0-fb02-4666-a630-761f020b105b","resolution":{"observed_at":"2026-08-01T00:42:12.527156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:12.646018Z","title":"Semantickitti: Adatasetforsemanticsceneunderstandingoflidarsequences","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:12.646018Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:b131e7393e6b5f2c8368959b4762f522f8daf44cdbf96f28ddb07e65eeb4c7f2","observation_id":"4681906b-0448-4861-9c19-3fcb07ab9b5d","resolution":{"observed_at":"2026-08-01T00:42:12.646018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02073","last_updated":"2025-04-21T12:09:08Z","snapshot_observed_at":"2026-08-02T06:32:26.688405Z","submitted_at":"2024-10-02T22:42:20Z","title":"Depth Pro: Sharp Monocular Metric Depth in Less Than a Second","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02073","snapshot_observed_at":"2026-08-01T00:42:12.732955Z","title":"Depth pro: Sharp monocular metric depth in less than a second.arXiv preprint arXiv:2410.02073, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:12.732955Z"},"links":{"cited_paper":"/paper/2410.02073","citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:93c015355fc4b4077bfbd811a9f87365e7a27effe0b7d63c4ddf7c2213fb74cb","observation_id":"71b037a6-349a-4251-8dea-ab7f7f59526f","resolution":{"observed_at":"2026-08-01T00:42:12.732955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:12.846763Z","title":"Cafuser: Condition-aware multimodal fusion for robust semantic perception of driving scenes.IEEE Robotics and Automation Letters, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:12.846763Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:ec9b0d1d4fb18252591147eb2388bbff1314385cb2fea1db5c940f9f829ef4b7","observation_id":"b88df963-0bb5-4e06-b6dd-88cb9b7385bd","resolution":{"observed_at":"2026-08-01T00:42:12.846763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:12.929231Z","title":"Dgfusion: Depth-guidedsensor fusion for robust semantic perception.IEEE Robotics and Automation Letters, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:12.929231Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:e2a4ef9a0739ca3eb92fad04d39eccd859fb45814068cacb9326ac39a113b318","observation_id":"5fe7c361-e909-487e-a23f-343f72140029","resolution":{"observed_at":"2026-08-01T00:42:12.929231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:13.015093Z","title":"End- to-end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:13.015093Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:267dab4e3ede7f7c1ce787ce78f2d95de285ad7653e216d4b3d9e156c7b880c1","observation_id":"629f1746-cd28-40d7-b325-81a6fd4a21a3","resolution":{"observed_at":"2026-08-01T00:42:13.015093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:13.092641Z","title":"Panoptic-deeplab: A simple, strong, and fast baseline for bottom-up panoptic segmentation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:13.092641Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:3d28caca2e59841ae6539a5cbe7cdad07dfd1d811d7b4674f476c7eaba534a8d","observation_id":"d3c08c3a-227a-4d94-8377-117a89f3abf8","resolution":{"observed_at":"2026-08-01T00:42:13.092641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:13.220990Z","title":"Per- pixel classification is not all you need for semantic segmenta- tion.NeurIPS, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:13.220990Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:0673521bec9d4217d710f5dbd4ff6dc1048433ee7679089a807cff086ba89c0a","observation_id":"ed09b1b6-ba50-4dd9-8216-f56560a16bdf","resolution":{"observed_at":"2026-08-01T00:42:13.220990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:13.317526Z","title":"Masked-attention mask trans- former for universal image segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:13.317526Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:0c8ab73d07ab1cd51485c4d0a957d345765f1368984ff60cd1ac5ea349ba1cb3","observation_id":"fa649f8e-6a73-4c72-b738-e879719cd41b","resolution":{"observed_at":"2026-08-01T00:42:13.317526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:13.437414Z","title":"The cityscapes dataset for semantic urban scene understanding","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:13.437414Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:64ca95d7e1d2f06d01add655251335786952e7e711363c017f72f90b3ee5a9a8","observation_id":"f98af75d-6873-4062-836c-1b15b4df02b1","resolution":{"observed_at":"2026-08-01T00:42:13.437414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:13.572993Z","title":"Depth map prediction from a single image using a multi-scale deep network.NeurIPS, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:13.572993Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:95b38cda24d20ce6741715be2cca74774e42ac0f39655da8d74e1e363947e420","observation_id":"b3608c8c-175d-462d-82b4-f35ef0a80e3e","resolution":{"observed_at":"2026-08-01T00:42:13.572993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:13.732609Z","title":"Cc-3dt: Panoramic 3d object tracking via cross-camera fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:13.732609Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:878f94061835e2efc277f81d65fdfed0e028ef182dfe5fe31f72744f252e2a00","observation_id":"dd13ff7d-249f-414e-af9d-84530f8b9109","resolution":{"observed_at":"2026-08-01T00:42:13.732609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:13.849629Z","title":"Qdtrack: Quasi-dense similarity learning for appearance-only multiple object tracking.T-PAMI, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:13.849629Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:0e095e9c63b74081c7e54cda4ff46973835d6eb94138108ec55655ca2992fb4f","observation_id":"e1ae02ae-b5a1-4ab0-b36f-ebbc8ec46178","resolution":{"observed_at":"2026-08-01T00:42:13.849629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:13.979899Z","title":"Panopticdepth: A unified framework for depth-aware panoptic segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:13.979899Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:53fafb3c041bd1f21ca3baedc6b13538b1e12208cea86d1f320102c03fdf036a","observation_id":"960e1f45-239a-41d6-837d-0e2c8ea603c3","resolution":{"observed_at":"2026-08-01T00:42:13.979899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:14.131099Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:14.131099Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:a0750737ede12306cdb88bc85fbff1ff8c8dd7861f778bc49155c00c933eb953","observation_id":"a8688b36-f9f4-42ee-95ac-5256b4719041","resolution":{"observed_at":"2026-08-01T00:42:14.131099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:14.249643Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:14.249643Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:cafa4016a243b93e2708721dbfe40b8062557b71f8507adc9f669aa166af5dcd","observation_id":"ee891143-37ae-460c-b955-a994e7d9964f","resolution":{"observed_at":"2026-08-01T00:42:14.249643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:14.371272Z","title":"Mask r-cnn","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:14.371272Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:399afea0518964df06f32457061a9e37d10fbedbc2c094c5b584f6bd5c07848c","observation_id":"e09c0a94-d6d7-4491-abb4-c6d3c7b3336a","resolution":{"observed_at":"2026-08-01T00:42:14.371272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:14.482458Z","title":"Monocular quasi-dense 3d object tracking.T-PAMI, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:14.482458Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:7312b7c766973bfde181862e129afdb92695e30deaff4a13b66bcd26be62c053","observation_id":"ac62a910-2d62-4214-8434-af1965080a1a","resolution":{"observed_at":"2026-08-01T00:42:14.482458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15506","last_updated":"2025-01-03T15:39:16Z","snapshot_observed_at":"2026-07-06T18:04:42.102581Z","submitted_at":"2024-03-22T02:30:46Z","title":"Metric3Dv2: A Versatile Monocular Geometric Foundation Model for Zero-shot Metric Depth and Surface Normal Estimation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15506","snapshot_observed_at":"2026-08-01T00:42:14.580703Z","title":"Metric3d v2: A versatile monocular geometric foundation model for zero-shot metric depth and surface normal estimation.arXiv preprint arXiv:2404.15506, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:14.580703Z"},"links":{"cited_paper":"/paper/2404.15506","citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:35eb139689bfe266b8d79a89f1ab77f9c5c2e98c091bdd085262745143078e5a","observation_id":"9b2b050f-b9f5-413c-a2a6-c0c3d1ac6d16","resolution":{"observed_at":"2026-08-01T00:42:14.580703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:14.683074Z","title":"Computervisionforautonomousvehicles: Problems,datasets and state of the art.Foundations and Trends in Computer Graphics and Vision, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:14.683074Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:6cca9b813e621bcf75ec819c3a15bf36ffda744f6e0c6d4c1e6f6cda67d4aa40","observation_id":"908a1ca5-c0cb-4a33-ba70-b24d52d36ea3","resolution":{"observed_at":"2026-08-01T00:42:14.683074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:14.827936Z","title":"Uni-dvps: Unified model for depth-aware video panoptic segmentation.IEEE Robotics and Automation Letters (RA-L), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:14.827936Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:3a5884b1be9fa29d94406cbe32281054e80719bc979998ff637c12b59e2ba4d4","observation_id":"e9c382c9-3b29-4fd9-957c-c8f22434f144","resolution":{"observed_at":"2026-08-01T00:42:14.827936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:14.948355Z","title":"Eager- mot: 3d multi-object tracking via sensor fusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:14.948355Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:12dd8d55ed5cdbb236b121402012db8e5731009b821908e1f1e38f38ff34ed24","observation_id":"706ed449-0b74-440f-bedc-c7ff67cfaa87","resolution":{"observed_at":"2026-08-01T00:42:14.948355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:15.051868Z","title":"Video panoptic segmentation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:15.051868Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:d288599c0ae2b4cff917dc190d28c998b26b394a0c96a8c152587c1ddbd7df19","observation_id":"6a4c67a3-c4d8-4f08-8bc9-18acce1cdb1e","resolution":{"observed_at":"2026-08-01T00:42:15.051868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:15.163731Z","title":"Semantic hierarchy- guided adversarial attack for autonomous driving.IEEE Robotics and Automation Letters, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:15.163731Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:981053f08af8cf12edc8a44c25348b8dcba4f3be382383fe7316dbd2ba8b2643","observation_id":"8431cba7-3505-4bdb-a304-172903e9ff65","resolution":{"observed_at":"2026-08-01T00:42:15.163731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-01T00:42:15.295980Z","title":"Adam: A method for stochastic optimization.arXiv preprint arXiv:1412.6980,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:15.295980Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:98eb3afbc7b5270cec8d6c544ce877be24e9830e77a1511a88eec263f8af468d","observation_id":"8341df67-c676-41e0-a713-ee6993ec9b67","resolution":{"observed_at":"2026-08-01T00:42:15.295980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:15.421111Z","title":"Panoptic segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:15.421111Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:a8de3a771243032c1b2386fd5f669b9896fc85fa17f586ca7e8202f41faca18d","observation_id":"f48d9ef6-f1ea-47ae-a219-83e789ac39cb","resolution":{"observed_at":"2026-08-01T00:42:15.421111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:15.527147Z","title":"Tracking every thing in the wild","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:15.527147Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:9b28fc4ec91ec091efb1bd8e7da068e5f6347fc8de072a37f92f3468950f6e58","observation_id":"e568084a-fe54-43f9-9f0f-94df7f8424d1","resolution":{"observed_at":"2026-08-01T00:42:15.527147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:15.680623Z","title":"Fully convolutional networks for panoptic segmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:15.680623Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:0205f1a3f8ba4b6174660083b8e23dfbd74d69e6a744379149699bd9dad55906","observation_id":"4f88d586-dfdb-43c8-a296-fa7bb61e904e","resolution":{"observed_at":"2026-08-01T00:42:15.680623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:15.765626Z","title":"Object-centric learning with slot attention.NeurIPS, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:15.765626Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:90cdadd4757f5b25beb29e932b3a069b4c8f9526e2e7b7efa130922e7926bc2f","observation_id":"9a44bc0b-ebf6-45ca-9821-1e8abe654c5c","resolution":{"observed_at":"2026-08-01T00:42:15.765626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:15.918797Z","title":"V-net: Fully convolutional neural networks for volumetric medical image segmentation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:15.918797Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:71c9db7c04f22b33b6cb0db8adbc687a37951bdba940c8db32d36b3325e8b716","observation_id":"ca56e4c1-4b4e-43a2-a8a3-495f03dbff13","resolution":{"observed_at":"2026-08-01T00:42:15.918797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:16.083115Z","title":"Scalableparallelprogrammingwithcuda: Iscudatheparallel programming model that application developers have been waiting for?Queue, 2008","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:16.083115Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:eb43c52e8c3cd561c4bf0345687d72996351943e3686a91ec20403ddf120116b","observation_id":"feee1c56-af29-4f56-9ff4-d0d72290ba51","resolution":{"observed_at":"2026-08-01T00:42:16.083115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:16.194823Z","title":"Quasi-densesimilaritylearning for multiple object tracking","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:16.194823Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:1b9ca72243788923efb0a33ab3277e742df14dfd9c480de1e8b35d1308f56cf1","observation_id":"fda85996-07a7-4c75-a718-5b0e6a2891a3","resolution":{"observed_at":"2026-08-01T00:42:16.194823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:16.278313Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:16.278313Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:dcd021783a2613819ab236982e21af3ea76d487b9e2a1fe20ae6c2bb7b0dd02f","observation_id":"d6833738-aafc-4a96-9d09-277767362d76","resolution":{"observed_at":"2026-08-01T00:42:16.278313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:16.332266Z","title":"Monodvps: A self- supervised monocular depth estimation approach to depth- aware video panoptic segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:16.332266Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:ac6afc553de3c1977b5846d1a12427cd45303e9e9088dab7ca4727f30ab6960f","observation_id":"1503eff7-081c-4f87-97a2-9e3ad3468d18","resolution":{"observed_at":"2026-08-01T00:42:16.332266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:16.456776Z","title":"iDisc: Internal discretization for monocular depth estimation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:16.456776Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:f2679778e81dd8ec78a862598453dc8f377e6e0fa3c71b49143df44fdbf8a3fd","observation_id":"f7cfccde-ae7d-4baa-8e71-7ba4a56028a7","resolution":{"observed_at":"2026-08-01T00:42:16.456776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:16.624983Z","title":"Unidepth: Universalmonocularmetricdepthestimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:16.624983Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:1e85d339a0512964d2c18025ea582551904d821dfeb695d8e8fa8c9ba8e40d8a","observation_id":"62dd0c55-fbfc-44ff-a448-6c31f5cfd08c","resolution":{"observed_at":"2026-08-01T00:42:16.624983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:16.780312Z","title":"UniK3D: Universal camera monocular 3d estimation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:16.780312Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:a0f20e3d07bac32fbe9184755a77d56e0bcf28f9e817d5a112fbe869ff60d97e","observation_id":"8c48bafa-9ab5-46c8-8313-1e0d22ec9e4f","resolution":{"observed_at":"2026-08-01T00:42:16.780312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20110","last_updated":"2025-12-18T09:32:11Z","snapshot_observed_at":"2026-08-02T05:41:31.119340Z","submitted_at":"2025-02-27T14:03:15Z","title":"UniDepthV2: Universal Monocular Metric Depth Estimation Made Simpler","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20110","snapshot_observed_at":"2026-08-01T00:42:16.905682Z","title":"UniDepthV2: Universal monocular metric depth estimation made simpler.arXiv:2502.20110, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:16.905682Z"},"links":{"cited_paper":"/paper/2502.20110","citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:2b51d07656062f90bd39f028e15d83735a3dee252c696bed6d13c1797988ebc2","observation_id":"51b98ed6-641b-4035-800e-6ec707d18ad2","resolution":{"observed_at":"2026-08-01T00:42:16.905682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:17.049244Z","title":"Vip-deeplab: Learning visual perception with depth-aware video panoptic segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:17.049244Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:6598299b01af801211ba80ef01c33175092fcd22cc47eda8d93a4144f3e928b8","observation_id":"7b484f29-e729-4d61-928a-6ef8792299da","resolution":{"observed_at":"2026-08-01T00:42:17.049244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:17.161756Z","title":"Balancing shared and task-specific repre- sentations: A hybrid approach to depth-aware video panoptic segmentation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:17.161756Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:6b34ce6a04826f1cca6d2364d2996b9626e92977728626b26202a301df2dd34e","observation_id":"ee4e7d8d-d202-4261-827d-4149869d6212","resolution":{"observed_at":"2026-08-01T00:42:17.161756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:17.333005Z","title":"Attention is all you need.NeurIPS, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:17.333005Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:0ae9118edb7c346ed108074b2c8277ca03fe9da6613b660299ff07ae67d5602c","observation_id":"8d3b4382-3177-48ea-a81c-b23bf2d8ebf0","resolution":{"observed_at":"2026-08-01T00:42:17.333005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:17.471014Z","title":"A good foundation is worth many labels: Label-efficient panoptic segmentation.IEEE Robotics and Automation Letters, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:17.471014Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:d13570d7b25876ee5e59737cebfdea84dabae664d2432714b2571c46284bc12d","observation_id":"9d3aec89-b23d-43b0-8de2-21731a8a6b80","resolution":{"observed_at":"2026-08-01T00:42:17.471014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:17.532621Z","title":"Fastdepth: Fast monocular depth estima- tion on embedded systems","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:17.532621Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:f2e3ba7157fc7820d5c32dd0f4f3e7610a3bcb478339f78a477a170bed81b096","observation_id":"f19527a7-311e-4bcb-a0d1-55161b116b22","resolution":{"observed_at":"2026-08-01T00:42:17.532621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:17.666799Z","title":"In defense of online models for video instance segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:17.666799Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:b04ff8e4961a0802637cddd7475c7353b632148ae5a4e4f9849fa560801a268f","observation_id":"6aac35ad-b1e8-41e2-9f6c-cf3e0ea24ad3","resolution":{"observed_at":"2026-08-01T00:42:17.666799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:17.813541Z","title":"Efficientdps: Efficient and end-to-end depth- aware panoptic segmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:17.813541Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:d4fc6a89979a0d4dbf91ab6a3ad1f2c1532cb470120165c3054630a97d380cfd","observation_id":"36c0de05-086d-4ea1-9572-a9628beffedb","resolution":{"observed_at":"2026-08-01T00:42:17.813541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:17.962081Z","title":"Upsnet: A unified panoptic segmentation network","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:17.962081Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:bf19912ff7f766a1f3b102aaca4c125ef2daf5560f75ce51a7a70c3cceb39f73","observation_id":"9f0c65ef-85af-4c6b-b49c-27882d5a1ff7","resolution":{"observed_at":"2026-08-01T00:42:17.962081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:18.117289Z","title":"Video instance segmentation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:18.117289Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:f95634aa0fc8ce329481e65b3d7fc9fa215792a79238296621e38d69dcd049cd","observation_id":"d7ce6714-b229-42fa-828b-bdd56d5bb18d","resolution":{"observed_at":"2026-08-01T00:42:18.117289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:18.283690Z","title":"k-means mask transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:18.283690Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:9cb518a3624a65b7ed31824290cbe927b95dd2224b7d2d677dbdc20916f96807","observation_id":"b852eabf-9494-4d1d-819d-41e6d6a226a4","resolution":{"observed_at":"2026-08-01T00:42:18.283690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:18.447856Z","title":"Polyphonicformer: unified query learning for depth-aware video panoptic segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:18.447856Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:859180f4e672986cd3a45c636ed28970c8f46f09f69c4b2dd578fe8baebc86fa","observation_id":"ef991ac2-7bc2-4b88-ba55-81b24f328dd9","resolution":{"observed_at":"2026-08-01T00:42:18.447856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:18.613084Z","title":"K-net: Towards unified image segmentation.NeurIPS,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:18.613084Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:f0316d42d044217195c8bddc5bf1a4a8653a1c00e0dacbbee2eb63c5a3b07a41","observation_id":"1b2a043c-89a2-45c6-9528-409005f74570","resolution":{"observed_at":"2026-08-01T00:42:18.613084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:42:18.781973Z","title":"Does computer vision matter for action?Science Robotics, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:18.781973Z"},"links":{"citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:29e6c28f9cb2158e07c16a4bbae8e28a25713cfe207ae44e179980f3bab751cb","observation_id":"e14b9012-c27e-49f6-9fe8-279d7fb6d50a","resolution":{"observed_at":"2026-08-01T00:42:18.781973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-07-06T10:02:45.105181Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-01T00:42:18.946960Z","title":"Deformabledetr: Deformabletransformersfor end-to-endobjectdetection.arXivpreprintarXiv:2010.04159,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T00:42:18.946960Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2607.26165"},"observation_digest":"sha256:14cd64f0eed30dffb7ec8c19c22e77241f01877f72e19eaad135dd43f667f140","observation_id":"18b9b8da-f1dd-4fe5-a2aa-e1ac836b66a5","resolution":{"observed_at":"2026-08-01T00:42:18.946960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.26165","last_updated":"2026-07-28T18:16:00Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T18:00:24.614342Z","submitted_at":"2026-07-28T18:16:00Z","title":"DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2607.26165."}