{"as_of":"2026-08-08T09:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1d3fa340829794e53851764ab358223e3943918e0dc562f1cdbc7c530d3c6baa","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:35:23.777947Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.10242/citation-record","integrity":"/paper/2506.10242/integrity","json":"/paper/2506.10242/citation-record.json","paper":"/paper/2506.10242"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.310299Z","title":"Z-forcing: Training stochastic recurrent networks","venue":null,"work_id":"ed9834ed-e3af-41df-9f87-86409765d700","year":null},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.629194Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:90eb2228857221435aa610925713e1162e7cd913b51b0921d4fe18c8c4ebfa11","observation_id":"8abcc4ae-5bd8-497d-986b-f29347edaba6","resolution":{"observed_at":"2026-08-07T04:35:24.313515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.301100Z","title":"nuscenes: A multi- modal dataset for autonomous driving","venue":null,"work_id":"71ea8e00-2bb3-481f-87f8-90f7cdf378ac","year":2020},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.632780Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:6a8dcd2d8eb3cc5295b509685a31509ac3bff07d8e0f25279280b46ca25ccc70","observation_id":"ff8814c9-257e-43c3-b423-4a781febe005","resolution":{"observed_at":"2026-08-07T04:35:24.304718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.292213Z","title":"End-to- end object detection with transformers","venue":null,"work_id":"2df16d2b-7b82-455c-9c4e-af4125349723","year":2020},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.636302Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:c2fe89b5f91284bc7145d6d43d63c6b3314ac59f95e0e0952105a4448e45cc88","observation_id":"00a75295-8a3c-4782-b297-c9b9655c3f1b","resolution":{"observed_at":"2026-08-07T04:35:24.295481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09626","last_updated":"2024-03-14T17:57:07Z","snapshot_observed_at":"2026-07-06T17:44:45.924645Z","submitted_at":"2024-03-14T17:57:07Z","title":"Video Mamba Suite: State Space Model as a Versatile Alternative for Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09626","snapshot_observed_at":"2026-08-07T04:35:23.639725Z","title":"Video mamba suite: State space model as a ver- satile alternative for video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.639725Z"},"links":{"cited_paper":"/paper/2403.09626","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:e9e6f82ffe9fe63a0202356b861c7bd7522bcafb2ecb2a4e87d535150c763020","observation_id":"d2b5b1d6-47b0-4bf8-afd0-2402e801fb73","resolution":{"observed_at":"2026-08-07T04:35:23.639725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.283239Z","title":"Adamixer: A fast-converging query-based object detector","venue":null,"work_id":"1c754ede-9b9a-4414-bcdf-961aee14ebf8","year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.643131Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:894c1c0f58f95ffd848bb521305f0354cea526f3e586abc7d1f329996d82cd1b","observation_id":"72982439-0b0f-472f-916d-58515dc24776","resolution":{"observed_at":"2026-08-07T04:35:24.286582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-07T04:35:23.650763Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.650763Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:d87d94112e53fbd64d3b844f8714749268e4a8c54225b180a21cb89f9427c70f","observation_id":"072cf3c4-d079-4339-963f-eb65167fe5e2","resolution":{"observed_at":"2026-08-07T04:35:23.650763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-07T04:35:23.653942Z","title":"Efficiently modeling long sequences with structured state spaces","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.653942Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:091232435a8bba4e86f19efaadab91b48692e18e79f5cd432db6dd2277a6cf29","observation_id":"63ae3aee-01c3-463a-ba75-06aba72a5d6d","resolution":{"observed_at":"2026-08-07T04:35:23.653942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:23.657336Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.657336Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:2915d035bbcd04785c77f3191586fc08e24f75b9dd94444969b81b55d11d9cd6","observation_id":"ae16e8a2-4e0a-442d-8e03-373b9931890a","resolution":{"observed_at":"2026-08-07T04:35:23.657336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-07T04:35:23.660995Z","title":"Bevdet4d: Exploit tempo- ral cues in multi-camera 3d object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.660995Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:3bcf0f4d807395723fe82088b7c0d220417db958a326851d825915e840f7b20e","observation_id":"0fabe1e0-660c-48a4-b6ff-2cceceddac60","resolution":{"observed_at":"2026-08-07T04:35:23.660995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.17111","last_updated":"2022-11-30T15:55:38Z","snapshot_observed_at":"2026-08-05T20:16:02.949910Z","submitted_at":"2022-11-30T15:55:38Z","title":"BEVPoolv2: A Cutting-edge Implementation of BEVDet Toward Deployment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.17111","snapshot_observed_at":"2026-08-07T04:35:23.664114Z","title":"Bevpoolv2: A cutting-edge implementation of bevdet toward deployment.arXiv preprint arXiv:2211.17111, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.664114Z"},"links":{"cited_paper":"/paper/2211.17111","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:d314efeb14507557e4774de214235ebe1e3d580d1390a4e76dc6c95dc710167c","observation_id":"9cf04c9f-8c4a-4f0f-8f32-235010ec904a","resolution":{"observed_at":"2026-08-07T04:35:23.664114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-07-06T12:21:28.059661Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-07T04:35:23.667697Z","title":"Bevdet: High-performance multi-camera 3d object de- tection in bird-eye-view","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.667697Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:caee6ff5a8aa739ddd44db315bfde53b82b781a886d5cc791652aa82675b3418","observation_id":"6b5c54e6-2cea-436f-a06a-6ea7aa32d0d4","resolution":{"observed_at":"2026-08-07T04:35:23.667697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.268543Z","title":"Leveraging vision-centric multi-modal expertise for 3d object detection","venue":null,"work_id":"1ec4b1a1-b3d7-4b40-bade-9dd486147050","year":null},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.671194Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:a22337e1feacc02b90ab0a71f36b4ddd923f01c14b9bb0bb08c86e539c084c50","observation_id":"aaf6c6e3-ad8e-4a31-87f5-c700edf0e74e","resolution":{"observed_at":"2026-08-07T04:35:24.271836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.258927Z","title":"Polarformer: Multi- camera 3d object detection with polar transformer","venue":null,"work_id":"2f569f98-2ec5-4165-a642-13be9eac18cf","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.675385Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:8372cb416d79a9e0ecdc95514c46c528be78ca695e0e0f377da996e4cb4fdc01","observation_id":"90608fdf-c32b-43da-a9c3-1e8f73556615","resolution":{"observed_at":"2026-08-07T04:35:24.262437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.248871Z","title":"Centermask: Real- time anchor-free instance segmentation","venue":null,"work_id":"81bcebe9-3fd1-45f8-84a9-c9e5c5d9903d","year":2020},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.679220Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:306557e80cf024bccc18abb927aabd5b1cbdf98e72a1d73749a0368eea5ecb2c","observation_id":"552a9ca0-bc53-46ff-8b5e-0ac4cdfe7d7a","resolution":{"observed_at":"2026-08-07T04:35:24.252214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-07-06T17:42:49.471518Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-07T04:35:23.682312Z","title":"Videomamba: State space model for efficient video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.682312Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:a08b5fb998f761faababa32b39ffd07e6cefd4ff9014df4dca830bc043f1a8b9","observation_id":"03a5c6c0-ad48-4a67-be9d-51d07e94ec7f","resolution":{"observed_at":"2026-08-07T04:35:23.682312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.238955Z","title":"Unifying voxel-based representation with transformer for 3d object detection","venue":null,"work_id":"93f78aa2-15e9-4f8c-81e8-b188f30127cc","year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.686094Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:d0742b93ad4d87924d278d73f2d677dbc9340164304756b72ff9720fb13c23ad","observation_id":"a5653bad-36d0-470b-aa78-782cb74e9dfd","resolution":{"observed_at":"2026-08-07T04:35:24.242284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.228674Z","title":"Bevstereo: Enhancing depth estimation in multi-view 3d object detection with temporal stereo","venue":null,"work_id":"b4fcdd5a-c4df-4e13-9979-d60f353c0afc","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.689354Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:9bc5e04699d666fe9537401f3e15a0b0762ad87ecfa83649b0a38f4f0d9f3ded","observation_id":"898d26c0-a53e-40aa-8407-e36678c0114b","resolution":{"observed_at":"2026-08-07T04:35:24.232330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.219655Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detec- tion","venue":null,"work_id":"195a6c43-bdb1-43b4-bcb4-2d158fab73a7","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.693042Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:78200abe5acb939ce20832db074d9798de587712c96793ef6cd86e888a1d6296","observation_id":"d2c88619-72eb-446e-84b6-371ab67aa6ab","resolution":{"observed_at":"2026-08-07T04:35:24.222857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.210707Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers","venue":null,"work_id":"c5ad3db7-d325-48f2-8759-b7ddc234186a","year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.696321Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:aa24e58e2a7dad1f297fb1c0d7a746b3b7c24157e03341ca68c7585f9ee82660","observation_id":"376b5c64-a8c1-4d66-9b7f-6a753f60a4c9","resolution":{"observed_at":"2026-08-07T04:35:24.214004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.201296Z","title":"Bevnext: Reviving dense bev frameworks for 3d object de- tection","venue":null,"work_id":"5d9dc7aa-efff-41d6-87ec-fc7ef8a99339","year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.699476Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:7f9f10b3516066be040575cc12e143bfd9cdd6ef03f1781d096c285ee6b206c0","observation_id":"2cea3e93-9536-48fb-a519-210cb9e6b785","resolution":{"observed_at":"2026-08-07T04:35:24.204687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-07T04:35:23.703406Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.703406Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:ae2ded5d03628c5cc8b020e877388514cf363352af29edcc6a2e505a4d5b907f","observation_id":"6be02f11-7fa4-40b4-ac06-aaf02d211a87","resolution":{"observed_at":"2026-08-07T04:35:23.703406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14018","last_updated":"2023-05-24T04:00:55Z","snapshot_observed_at":"2026-07-06T15:31:23.076745Z","submitted_at":"2023-05-23T12:53:58Z","title":"Sparse4D v2: Recurrent Temporal Fusion with Sparse Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14018","snapshot_observed_at":"2026-08-07T04:35:23.707571Z","title":"Sparse4d v2: Recurrent temporal fusion with sparse model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.707571Z"},"links":{"cited_paper":"/paper/2305.14018","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:36886db0b2f694155d6ed495b46a4029fc122e0891bc6a3548127c7763b84204","observation_id":"71262ffe-2505-487d-ae8a-3456c748107b","resolution":{"observed_at":"2026-08-07T04:35:23.707571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03634","last_updated":"2024-03-12T07:38:34Z","snapshot_observed_at":"2026-07-06T17:25:58.305593Z","submitted_at":"2024-02-06T02:17:44Z","title":"Ray Denoising: Depth-aware Hard Negative Sampling for Multi-view 3D Object Detection","version":2},"cited_work":{"arxiv_id":"2402.03634","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.03634","snapshot_observed_at":"2026-08-07T04:35:23.878217Z","title":"Ray Denoising: Depth-aware Hard Negative Sampling for Multi-view 3D Object Detection","venue":"cs.CV","work_id":"0cefc5f8-b43d-42f5-aaff-f33a1a150c93","year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.710929Z"},"links":{"cited_paper":"/paper/2402.03634","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:b01db6a1542c546eb33f6c7dcb9cab859ab991a7bf9c6b8a6a7630b230a96f21","observation_id":"dfa006e2-065c-4f5f-ab7e-891dc5cab592","resolution":{"observed_at":"2026-08-07T04:35:23.884066Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.192229Z","title":"Sparsebev: High-performance sparse 3d object de- tection from multi-camera videos","venue":null,"work_id":"a04bcfef-36b5-4324-8847-2729abb474ce","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.714318Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:18877bd231df9f5aefea8b10b782bfb2b4ac9ec5fe73b2b64a7bdcf2c77c17f2","observation_id":"381d2629-124c-4b34-ad60-c7da18e7324d","resolution":{"observed_at":"2026-08-07T04:35:24.195665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.182495Z","title":"Petr: Position embedding transformation for multi-view 3d object detection","venue":null,"work_id":"9a815626-ec71-4647-b5a0-0f86b1563d42","year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.717576Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:56944783f27f3ae4766feaa3bbe8516e15eab02b088f93cb1148bcddd4778313","observation_id":"b1e2e4a1-68cf-4148-b0d7-19e5d0f63fbc","resolution":{"observed_at":"2026-08-07T04:35:24.185889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.171699Z","title":"Petrv2: A unified framework for 3d perception from multi-camera images","venue":null,"work_id":"8db74017-738d-40f4-9d75-a5d7cf162dae","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.721298Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:d88b4f9ee2b282d7076a161a0825f32457d223fb9aebd00b6ef54ef4297ff21c","observation_id":"43cdd979-3738-4025-8915-e45aa45801cc","resolution":{"observed_at":"2026-08-07T04:35:24.175069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10166","last_updated":"2024-12-29T14:57:13Z","snapshot_observed_at":"2026-07-06T17:17:31.008185Z","submitted_at":"2024-01-18T17:55:39Z","title":"VMamba: Visual State Space Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10166","snapshot_observed_at":"2026-08-07T04:35:23.724665Z","title":"Vmamba: Visual state space model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.724665Z"},"links":{"cited_paper":"/paper/2401.10166","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:8841b8b4bd15a1592d67198741d2f281f6d61619e55b4aa484e0f57aa5848011","observation_id":"ff040686-4235-4740-89bb-e593e723f301","resolution":{"observed_at":"2026-08-07T04:35:23.724665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18232","last_updated":"2024-07-25T17:50:32Z","snapshot_observed_at":"2026-08-04T23:01:03.964449Z","submitted_at":"2024-07-25T17:50:32Z","title":"LION: Linear Group RNN for 3D Object Detection in Point Clouds","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18232","snapshot_observed_at":"2026-08-07T04:35:23.728353Z","title":"Lion: Linear group rnn for 3d object detection in point clouds","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.728353Z"},"links":{"cited_paper":"/paper/2407.18232","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:9fa3dd71e56a2a356139dd70f2793d4901bf0ff9e4cd39e8242eb554bc389399","observation_id":"f7600ef8-104e-4a9a-862d-ff40f676d13b","resolution":{"observed_at":"2026-08-07T04:35:23.728353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.161438Z","title":"Is pseudo-lidar needed for monocular 3d object detection? In Proceedings of the IEEE/CVF Inter- national Conference on Computer Vision, pages 3142–3152,","venue":null,"work_id":"f7e4df1d-5254-438e-83f8-ae0432f6f3c4","year":null},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.731580Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:50a8e5c5720ce1e3e383e35fa772599c004d6e57a9905f1414db7a121ba9ee1b","observation_id":"b3e25ff0-c383-489c-bf06-a17606c4e8e5","resolution":{"observed_at":"2026-08-07T04:35:24.165043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.151240Z","title":"Time will tell: New outlooks and a baseline for temporal multi- view 3d object detection","venue":null,"work_id":"cba5fd6e-d282-4827-a4a2-dbae8e35c49a","year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.735080Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:53228cc8415715be9f8874e2c4ad58e3afad6cdfc778eda968c532b8510ad935","observation_id":"41c17b56-c10d-49fc-8e8f-2de7ac7eb03e","resolution":{"observed_at":"2026-08-07T04:35:24.154869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.141442Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unprojecting to 3d","venue":null,"work_id":"9668c8c6-8bbd-4dd0-b0bc-a8c091504f0e","year":2020},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.738676Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:4abc1c80a3b88e73e23c74e28dfb7907ae86c0e15c22427c381c1d312e627a0e","observation_id":"cd05786b-db7d-4383-acb0-117340bb2384","resolution":{"observed_at":"2026-08-07T04:35:24.144677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.131154Z","title":"Amixer: Adaptive weight mixing for self-attention free vi- sion transformers","venue":null,"work_id":"843f0e9a-9341-45b7-ad71-18b7e329563e","year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.741820Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:7f8ade2a6aea5b46eb9298cf185d711bffbb0ebee93f16edd80321dd4320367e","observation_id":"8312d47f-2751-4b0b-91e2-4bc6808db416","resolution":{"observed_at":"2026-08-07T04:35:24.134679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.04933","last_updated":"2023-03-03T18:35:28Z","snapshot_observed_at":"2026-07-06T13:40:19.948018Z","submitted_at":"2022-08-09T17:57:43Z","title":"Simplified State Space Layers for Sequence Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.04933","snapshot_observed_at":"2026-08-07T04:35:23.744886Z","title":"Simplified state space layers for sequence modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.744886Z"},"links":{"cited_paper":"/paper/2208.04933","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:4328830803fbb83ba9902b2fe6e6b86b8b56ce15e92a66406ace6fd94df2a65c","observation_id":"f943a34d-ffaf-479f-b21e-2ccb0738c025","resolution":{"observed_at":"2026-08-07T04:35:23.744886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.02872","last_updated":"2021-02-11T14:55:12Z","snapshot_observed_at":"2026-07-06T10:38:35.211339Z","submitted_at":"2021-02-04T20:18:56Z","title":"Feedback in Imitation Learning: The Three Regimes of Covariate Shift","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.02872","snapshot_observed_at":"2026-08-07T04:35:23.748313Z","title":"Feedback in imitation learning: The three regimes of covariate shift","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.748313Z"},"links":{"cited_paper":"/paper/2102.02872","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:d71fb5e6bdab687bcd8f8c38b299a0e5eed75bb2923213b150165d5ec7ad5df6","observation_id":"22e6d20e-9f48-43ba-8909-bafc9fa77582","resolution":{"observed_at":"2026-08-07T04:35:23.748313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:23.751851Z","title":"Sparse r-cnn: End-to-end ob- ject detection with learnable proposals","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.751851Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:18281a02a479340540b0ed82ee7c4a730ab65c294c733b7438e9ca096746e728","observation_id":"773f210f-2485-48c6-b672-13bf217709fa","resolution":{"observed_at":"2026-08-07T04:35:23.751851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.112908Z","title":"Exploring object-centric temporal modeling for efficient multi-view 3d object detection","venue":null,"work_id":"f56442f3-2168-4399-807b-254d029049b6","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.754954Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:a3ffb89ca5095d225eaba860387858fb34083f5374d40a1c70116c953a3b9ea9","observation_id":"1cc512b2-bae8-47ff-9679-7bcf4584195e","resolution":{"observed_at":"2026-08-07T04:35:24.116419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.102393Z","title":"Detr3d: 3d object detection from multi-view images via 3d-to-2d queries","venue":null,"work_id":"f692d482-9098-4c03-9c4d-16046913768c","year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.758083Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:91d77edfa690f9ec73f51edbaf695232f6083b63eea11ccb1c4496c4e40c9f11","observation_id":"145a6662-c094-4ccf-8f7f-689f421b461c","resolution":{"observed_at":"2026-08-07T04:35:24.106135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.091808Z","title":"Bevformer v2: Adapting modern image backbones to bird’s-eye-view recognition via perspective su- pervision","venue":null,"work_id":"7c3d3838-dbe2-480c-a093-705f55c0f11e","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.761181Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:589514e538c397e4a1c544ab52045ba8f3b420abe4894df127795624d7c1380b","observation_id":"5c1f1d61-21c1-4b85-80ac-4925e43d6352","resolution":{"observed_at":"2026-08-07T04:35:24.095452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.080268Z","title":"Futuredepth: Learning to predict the future improves video depth estimation","venue":null,"work_id":"f7bff509-25c3-4235-8c73-9c3772ff7b84","year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.764411Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:1f74141c1296aefbb82ccd063b225837fa64cd94b1a3b09c6a9fc9f622cd9c70","observation_id":"6978be83-7ce9-40b7-8caf-c875f4e59fa7","resolution":{"observed_at":"2026-08-07T04:35:24.084632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10700","last_updated":"2024-06-18T17:49:56Z","snapshot_observed_at":"2026-07-06T18:31:32.118399Z","submitted_at":"2024-06-15T17:45:07Z","title":"Voxel Mamba: Group-Free State Space Models for Point Cloud based 3D Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10700","snapshot_observed_at":"2026-08-07T04:35:23.767553Z","title":"V oxel mamba: Group-free state space models for point cloud based 3d object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.767553Z"},"links":{"cited_paper":"/paper/2406.10700","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:3783f702778a4b91c6022528951e8a1a095c79c294265786ade76eda6b174083","observation_id":"d8f0321b-8d7e-4c0f-bbc6-d42b361ea5c3","resolution":{"observed_at":"2026-08-07T04:35:23.767553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.09492","last_updated":"2019-08-26T06:27:01Z","snapshot_observed_at":"2026-07-06T08:16:42.834645Z","submitted_at":"2019-08-26T06:27:01Z","title":"Class-balanced Grouping and Sampling for Point Cloud 3D Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.09492","snapshot_observed_at":"2026-08-07T04:35:23.770789Z","title":"Class-balanced grouping and sampling for point cloud 3d object detection","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.770789Z"},"links":{"cited_paper":"/paper/1908.09492","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:00e99d3a7c47418b744fcc3325ec8f3689ae807c08541eb345c6749ca2041ba9","observation_id":"2d2795a2-1547-4d27-9d97-e9d59e7b803f","resolution":{"observed_at":"2026-08-07T04:35:23.770789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09417","last_updated":"2024-11-14T02:00:33Z","snapshot_observed_at":"2026-07-06T17:16:59.193820Z","submitted_at":"2024-01-17T18:56:18Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09417","snapshot_observed_at":"2026-08-07T04:35:23.774219Z","title":"Vision mamba: Efficient visual representation learning with bidirectional state space model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.774219Z"},"links":{"cited_paper":"/paper/2401.09417","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:062c1b4f9ae3110beb5cd26256785fb215758a63822894248441eaa5cd970ea8","observation_id":"7506a64c-3eb8-46a9-8abc-03f141def9c0","resolution":{"observed_at":"2026-08-07T04:35:23.774219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:23.982631Z","title":"Temporal enhanced training of multi-view 3d object detector via historical object prediction","venue":null,"work_id":"d122ecdd-e43e-41fc-b002-ff2666190484","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.777947Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:1d926bbe7b6b43e556d78bfa0a3c38a54f1ce646467efcd78c1ef6d72d7f33df","observation_id":"328f2d44-07b8-4ae2-a427-37310b7a8cee","resolution":{"observed_at":"2026-08-07T04:35:23.986458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2506.10242."}