{"as_of":"2026-08-08T10:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:80b627eee7164f894c7884f1f792c98eb5c8893d4439a3861cd2f77015e56819","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:53:14.686363Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T20:25:42.586436Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T20:28:14.003631Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"cited_work":{"arxiv_id":"2507.04369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04369","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mambafusion: Height-fidelity dense global fusion for multi-modal 3d object detection","venue":null,"work_id":"3722c61a-01d5-4245-9f04-2d1b3534414f","year":2025},"citing_paper":{"arxiv_id":"2604.02903","last_updated":"2026-04-03T09:20:48Z","snapshot_observed_at":"2026-07-06T22:52:10.923214Z","submitted_at":"2026-04-03T09:20:48Z","title":"RayMamba: Ray-Aligned Serialization for Long-Range 3D Object Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T20:25:42.586436Z"},"links":{"cited_paper":"/paper/2507.04369","citing_paper":"/paper/2604.02903"},"observation_digest":"sha256:d0ea18a65ead359486e1352c14367d62b157f6f5b1938b08f108049f757585ac","observation_id":"e6c7cd6a-1b93-422b-9f1e-2d6dc46e8eaa","resolution":{"observed_at":"2026-05-13T20:28:14.004991Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.04369/citation-record","integrity":"/paper/2507.04369/integrity","json":"/paper/2507.04369/citation-record.json","paper":"/paper/2507.04369"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.899843Z","title":"Transfusion: Robust lidar-camera fusion for 3d object detection with transform- ers","venue":null,"work_id":"74892b79-27ae-4268-a44e-80a46a3060df","year":2022},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:09.327670Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:9816e802acc594db3e30c1e907d4c939477cd3003ec510482f09f7ad02888e2e","observation_id":"7f6662d1-f0b1-409b-9fb1-0c68d88bb57c","resolution":{"observed_at":"2026-08-06T19:53:18.902818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.891916Z","title":"nuscenes: A mul- timodal dataset for autonomous driving","venue":null,"work_id":"510303f3-2a09-4208-91b1-cbb1e9775770","year":2020},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:09.404996Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:362d2c7e24f90935009d8100067bdd3fd37c40847fa7a283424af3e608088c08","observation_id":"b3eda33e-46db-4c65-b891-c2923b029171","resolution":{"observed_at":"2026-08-06T19:53:18.894680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.883392Z","title":"Objectfusion: Multi-modal 3d object detection with object-centric fusion","venue":null,"work_id":"6fab0194-8dce-4715-99fc-6ef78d5265ad","year":2023},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:09.447108Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:14bc3a5a4d2b33b194fc72717d0b737549b3ce34f41b43f11ee476d686c3e106","observation_id":"918ff96f-d72b-43a5-a916-5e893c0b5e86","resolution":{"observed_at":"2026-08-06T19:53:18.886402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.875312Z","title":"Deformable feature aggrega- tion for dynamic multi-modal 3d object detection","venue":null,"work_id":"df8a7736-6b4d-464e-8411-a8652ba01bf2","year":2022},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:09.530411Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:89b8d3286818f8d1a57ed86eb6d255baeb33880dea7350f583f3c1f7b8cacc8c","observation_id":"ba11ef17-a941-4e01-b82b-6e551b717d49","resolution":{"observed_at":"2026-08-06T19:53:18.878257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-06T19:53:09.637466Z","title":"Transformers are ssms: General- ized models and efficient algorithms through structured state space duality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:09.637466Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:a08e69c0e52a643e242511c0432a4dc1071f7fd95aa6f749484042e86981e2fc","observation_id":"9d7e4252-0883-4157-a37c-9c2b82b87bc3","resolution":{"observed_at":"2026-08-06T19:53:09.637466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.867120Z","title":"Scaling up your kernels to 31x31: Revisiting large kernel design in cnns","venue":null,"work_id":"f0b15621-644a-4f27-aa54-cd19451479cd","year":2022},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:09.724831Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:357f782da146eac78e97b88c03c859994fa65768385c551fd7fac5519b139b33","observation_id":"25832c21-008a-4fc5-ab7f-7423f0fa7915","resolution":{"observed_at":"2026-08-06T19:53:18.870098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01037","last_updated":"2024-08-02T06:20:48Z","snapshot_observed_at":"2026-07-06T18:55:57.425474Z","submitted_at":"2024-08-02T06:20:48Z","title":"MambaST: A Plug-and-Play Cross-Spectral Spatial-Temporal Fuser for Efficient Pedestrian Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01037","snapshot_observed_at":"2026-08-06T19:53:09.830520Z","title":"Mambast: A plug-and-play cross-spectral spatial- temporal fuser for efficient pedestrian detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:09.830520Z"},"links":{"cited_paper":"/paper/2408.01037","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:9d0e19c7719c49293205b6d3066c0eb9f824d716ba686740084d811b54f6dcad","observation_id":"125403d5-98a4-4724-9521-4a2e9b64c920","resolution":{"observed_at":"2026-08-06T19:53:09.830520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-06T19:53:09.916242Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:09.916242Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:09992e43fd821d8b64a854bcd6373dd3970175579d0f26f89f9c137afa21daf2","observation_id":"54d53103-cb29-4991-9d86-45607897642e","resolution":{"observed_at":"2026-08-06T19:53:09.916242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.858659Z","title":"Hippo: Recurrent memory with optimal polynomial projections","venue":null,"work_id":"ad5ad62f-f6ac-4367-8f42-475c269ecdbc","year":2020},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.025079Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:83671fae896906a4563ddd8cfd03b0622167902eb674dfcdfe07ba5665b08a81","observation_id":"bd69ea9e-0b71-4a0a-8b07-820619c10aec","resolution":{"observed_at":"2026-08-06T19:53:18.861609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-06T19:53:10.089993Z","title":"Efficiently modeling long sequences with structured state spaces","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.089993Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:b5f5c88d3d3bc4cbb07e8e57f693d0995572431edd7a439b4e9071dd2b3eeb8d","observation_id":"89384ac7-8703-4a96-a1ee-47d4a7a0c8c5","resolution":{"observed_at":"2026-08-06T19:53:10.089993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.850167Z","title":"Combining recurrent, convolutional, and continuous-time models with linear state space layers","venue":null,"work_id":"b0eca3ed-3111-41a0-9bd0-f9a4878655f4","year":2021},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.173576Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:c2d24f5fe3282bb1ef6e3bb02456e684ce9c8840c01e20309fd7861a47139b8b","observation_id":"73bdba02-4285-4e46-93a6-e9e8b20ed012","resolution":{"observed_at":"2026-08-06T19:53:18.853166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.841744Z","title":"Exploring recurrent long-term temporal fusion for multi-view 3d perception","venue":null,"work_id":"cbe4ca00-9381-4eba-a026-4a60835cbaa2","year":2024},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.256213Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:fa4163e731c810200756cca5523ad916ce67c72e6fd064061923b41037846598","observation_id":"c6e30259-ae9a-4000-8f7f-db30f0fea1c5","resolution":{"observed_at":"2026-08-06T19:53:18.844718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.832914Z","title":"Demystify mamba in vision: A linear attention perspective","venue":null,"work_id":"f0a55221-730d-41a1-97aa-139e9fec864e","year":2025},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.332833Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:d42b38c1d3a4201a04bede1d181c14cdb1503f4f54c8e1ebc9884513e57689f1","observation_id":"d9439a9e-a34a-4876-8d3f-56fa6e368f4f","resolution":{"observed_at":"2026-08-06T19:53:18.835904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.824431Z","title":"Linear systems theory","venue":null,"work_id":"75e0e4cf-ca8d-4761-8865-db2acc50c281","year":2018},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.401643Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:8ebe5a86bea8c6bd0080bfbe9d62e6e1f4347efa04432e1fe4bf34dd5faeb6a5","observation_id":"d9b3cf0c-60ed-4b3b-9b8e-2888831d88c6","resolution":{"observed_at":"2026-08-06T19:53:18.827413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.815825Z","title":"¨Uber die stetige abbildung einer linie auf ein fl ¨achenst¨uck","venue":null,"work_id":"b862938d-f21d-4438-afb6-162720bab051","year":1935},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.471557Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:b9c75dfa3afc8466cd34472e292c577a85f2a07958965f813e5c74e03b7e34a5","observation_id":"d607fa31-21d6-4b92-a791-217b4235edf0","resolution":{"observed_at":"2026-08-06T19:53:18.818961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-07-06T12:21:28.059661Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-06T19:53:10.551923Z","title":"Bevdet: High-performance multi-camera 3d object de- tection in bird-eye-view","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.551923Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:207f13c3bc08b1d3110336266f10010ba841dd6ac1ab634480561245ef57a760","observation_id":"f64da63d-be82-48e0-8346-9666e1ad68fd","resolution":{"observed_at":"2026-08-06T19:53:10.551923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.806834Z","title":"Detecting as labeling: Rethinking lidar-camera fusion in 3d object detection","venue":null,"work_id":"be011835-7e22-4b3f-9132-69a15c4e51d6","year":null},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.627212Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:4c9d482e1d5a4dbf07e8f29cd1306d1c649e404cdd2329a6ecf6c3cd6e91cad3","observation_id":"7666fd88-9d60-4a01-99dc-dff0a76bb92b","resolution":{"observed_at":"2026-08-06T19:53:18.809908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.797626Z","title":"Ep- net: Enhancing point features with image semantics for 3d object detection","venue":null,"work_id":"bec532c0-7351-4afc-848b-3e7ec0ec0601","year":2020},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.708011Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:def9ac21ffcca0730c6faef831fa71a3e9f8834df48c0ea89d3595d951977bbc","observation_id":"2a04bb29-ff19-4133-bfad-f4d37ca6d1ce","resolution":{"observed_at":"2026-08-06T19:53:18.800645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.788240Z","title":"Ccnet: Criss-cross attention for semantic segmentation","venue":null,"work_id":"4a885aad-d840-4d14-9541-dd088d1356e2","year":2019},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.789930Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:1dbd5e461e9b71c8daa56a95498aa22af083c172dd0fe443dd5c3815c08a7738","observation_id":"4f23ab82-31ed-4c0a-98c1-54eb27c4e775","resolution":{"observed_at":"2026-08-06T19:53:18.791294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.779550Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention","venue":null,"work_id":"a91eab01-4bdf-4338-818f-d2303a43c15d","year":null},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.869032Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:74de4b8475d3138f9452bbfe14af96f146132580a4380ce09c3fb6e29fdc1c7c","observation_id":"ffdf79af-83ba-4b15-9f15-22e7306640a6","resolution":{"observed_at":"2026-08-06T19:53:18.782680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.768802Z","title":"Unifying voxel-based representation with transformer for 3d object detection","venue":null,"work_id":"50961c92-7d18-42a6-a8dc-dd156fea81b8","year":2022},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.942244Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:039c9e71e0572c318de9b95a886eea87f6069414428ddbdc0c99acf390d34818","observation_id":"0700665b-cbb6-4471-8c00-10896ce05488","resolution":{"observed_at":"2026-08-06T19:53:18.772298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.758413Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detec- tion","venue":null,"work_id":"fc4b1d45-ac71-486e-a155-43dc4f004545","year":2023},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.018496Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:8cd02d07732e951976fe66692cfea7bfa0f0d32d00fc49a7dae897dc08af50e6","observation_id":"12457271-c637-4fcf-b5e9-62b9056a74b6","resolution":{"observed_at":"2026-08-06T19:53:18.761995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:11.096668Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.096668Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:8e0c759311b575f429a3c2fd37faee6472488a441f4558326990335b19d517d7","observation_id":"af440817-e787-45e5-9b47-0a8f4b2910f7","resolution":{"observed_at":"2026-08-06T19:53:11.096668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17442","last_updated":"2025-01-13T05:36:58Z","snapshot_observed_at":"2026-07-06T18:36:38.636181Z","submitted_at":"2024-06-25T10:23:53Z","title":"Pamba: Enhancing Global Interaction in Point Clouds via State Space Model","version":3},"cited_work":{"arxiv_id":"2406.17442","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.17442","snapshot_observed_at":"2026-08-06T19:53:14.904142Z","title":"Pamba: Enhancing Global Interaction in Point Clouds via State Space Model","venue":"cs.CV","work_id":"4d81cdf8-3adc-4bbb-8b8e-49d420dc94de","year":2024},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.226058Z"},"links":{"cited_paper":"/paper/2406.17442","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:f3d5349b92be1aa7e58b2ca812a05d68ea9d3ac391cd783be6c8565b9963f542","observation_id":"674bbf8f-07c0-4526-b06b-e071b4a92882","resolution":{"observed_at":"2026-08-06T19:53:14.953914Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10739","last_updated":"2024-11-25T01:45:35Z","snapshot_observed_at":"2026-07-06T17:31:13.010759Z","submitted_at":"2024-02-16T14:56:13Z","title":"PointMamba: A Simple State Space Model for Point Cloud Analysis","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10739","snapshot_observed_at":"2026-08-06T19:53:11.303213Z","title":"Point- mamba: A simple state space model for point cloud analysis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.303213Z"},"links":{"cited_paper":"/paper/2402.10739","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:c7f5e65fcbf534512c7b5f214276cd843d3dea9b0573a807b294978717106727","observation_id":"7f0a26f2-b3d8-42d8-97db-043130919021","resolution":{"observed_at":"2026-08-06T19:53:11.303213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.741055Z","title":"Bevfusion: A simple and robust lidar-camera fusion framework","venue":null,"work_id":"6234e1fb-08f2-4989-b1f1-f0711eb05c60","year":2022},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.408650Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:b46a4365402f945846303f9dd4688c493c151f927e9e4a425859d633a6f1c0bc","observation_id":"d499cdd6-9c14-48e8-b165-0bf3619e20c5","resolution":{"observed_at":"2026-08-06T19:53:18.744328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14018","last_updated":"2023-05-24T04:00:55Z","snapshot_observed_at":"2026-07-06T15:31:23.076745Z","submitted_at":"2023-05-23T12:53:58Z","title":"Sparse4D v2: Recurrent Temporal Fusion with Sparse Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14018","snapshot_observed_at":"2026-08-06T19:53:11.510879Z","title":"Sparse4d v2: Recurrent temporal fusion with sparse model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.510879Z"},"links":{"cited_paper":"/paper/2305.14018","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:6df98ca4351f8f89d075f14e58c98c20d05800acac2337880a1d612bb6803afd","observation_id":"f74be71b-950a-4892-99a5-6ea0a36a8be1","resolution":{"observed_at":"2026-08-06T19:53:11.510879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.731343Z","title":"Sparsebev: High-performance sparse 3d object de- tection from multi-camera videos","venue":null,"work_id":"f931e26c-91a7-4447-8ee5-3c090b804d52","year":2023},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.583910Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:3f24097827b7f16207b9bd8ab62aed39448af4b03f8a9a19317b288e1ab770ea","observation_id":"be20c57e-02c6-4105-9e58-82ba3a1fae3f","resolution":{"observed_at":"2026-08-06T19:53:18.734728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.03620","last_updated":"2023-03-03T19:04:38Z","snapshot_observed_at":"2026-07-06T13:29:01.537889Z","submitted_at":"2022-07-07T23:55:52Z","title":"More ConvNets in the 2020s: Scaling up Kernels Beyond 51x51 using Sparsity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.03620","snapshot_observed_at":"2026-08-06T19:53:11.652490Z","title":"More convnets in the 2020s: Scaling up kernels beyond 51x51 using sparsity","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.652490Z"},"links":{"cited_paper":"/paper/2207.03620","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:abab255d86c1433c983625925eba296880600cfcab43fe5ecafb6f806924db8a","observation_id":"571a1690-a7c7-4193-a6ef-702b69feb4dd","resolution":{"observed_at":"2026-08-06T19:53:11.652490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.721039Z","title":"Petr: Position embedding transformation for multi-view 3d object detection","venue":null,"work_id":"3f489dc0-a482-45e4-9150-1df01d358a66","year":2022},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.735153Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:0af7b37eb3d0e0851def93f9f00b8c85f652f22bc5de513740c731971282c232","observation_id":"09423810-0bf1-4024-82fc-8cee9e03a053","resolution":{"observed_at":"2026-08-06T19:53:18.724495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10166","last_updated":"2024-12-29T14:57:13Z","snapshot_observed_at":"2026-07-06T17:17:31.008185Z","submitted_at":"2024-01-18T17:55:39Z","title":"VMamba: Visual State Space Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10166","snapshot_observed_at":"2026-08-06T19:53:11.829048Z","title":"Vmamba: Visual state space model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.829048Z"},"links":{"cited_paper":"/paper/2401.10166","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:58299a211587905020b3af408c4bdcae5458b5b0260764f4921b9ed35f0c447b","observation_id":"14c1aef3-7d28-41c0-aa02-9f560bb4e501","resolution":{"observed_at":"2026-08-06T19:53:11.829048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.710805Z","title":"Bevfusion: Multi- task multi-sensor fusion with unified bird’s-eye view repre- sentation","venue":null,"work_id":"c9019709-cabb-4a8c-ac4d-f58ed9a84982","year":2023},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.923708Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:6a13746e04d23d2ef63d9d291f747b4539d96e6b120a689730f26efffcdab323","observation_id":"30564855-7d48-40a9-a30c-5f4d1463e3f7","resolution":{"observed_at":"2026-08-06T19:53:18.714261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18232","last_updated":"2024-07-25T17:50:32Z","snapshot_observed_at":"2026-08-04T23:01:03.964449Z","submitted_at":"2024-07-25T17:50:32Z","title":"LION: Linear Group RNN for 3D Object Detection in Point Clouds","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18232","snapshot_observed_at":"2026-08-06T19:53:12.002104Z","title":"Lion: Linear group rnn for 3d object detection in point clouds","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.002104Z"},"links":{"cited_paper":"/paper/2407.18232","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:fd4aaf68b34674ca2f64b49508b6e72aa83dc479e5f70e7d7eebcdb568f7533a","observation_id":"19471f13-bc9f-45c4-9ea3-c16dd9793ddc","resolution":{"observed_at":"2026-08-06T19:53:12.002104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.652986Z","title":"A computer oriented geodetic data base and a new technique in file sequencing","venue":null,"work_id":"fd369a0d-147f-4953-b62d-7fe7fb31cb79","year":1966},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.089824Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:ebe9d9a9e4cca7bcf8318ffa9874aababef7220ee945cacd912b0448bd384209","observation_id":"18bc27df-79e0-43ec-8307-eec5627dc91c","resolution":{"observed_at":"2026-08-06T19:53:18.702836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13048","last_updated":"2023-12-11T03:58:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T13:57:41Z","title":"RWKV: Reinventing RNNs for the Transformer Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13048","snapshot_observed_at":"2026-08-06T19:53:12.171269Z","title":"Rwkv: Reinventing rnns for the transformer era","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.171269Z"},"links":{"cited_paper":"/paper/2305.13048","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:8cf114e07196448959eb1cb780933fb0ddfd5da0e163396645e87da14a8e86e8","observation_id":"fb343fee-f629-4058-acd6-411b63589528","resolution":{"observed_at":"2026-08-06T19:53:12.171269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.447545Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unprojecting to 3d","venue":null,"work_id":"6fb944df-1d97-4586-99f8-e8844d84d756","year":2020},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.268044Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:b2b24b5bf16d41e186b75df202de3de2a2f4f07a5e86ac13016a487f94cf1f36","observation_id":"0e632b4d-be12-4b43-a7e0-b7dd714cb953","resolution":{"observed_at":"2026-08-06T19:53:18.522881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:18.214203Z","title":"Pointnet++: Deep hierarchical feature learning on point sets in a metric space","venue":null,"work_id":"b0fa6da6-d2c5-4bed-8d35-8389431a5814","year":2017},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.349132Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:a4c0b4702b804986673cbfd8e78282facd290c9647a7e9471460042f8da56088","observation_id":"6a627866-d31c-43dd-8f68-0690606c7581","resolution":{"observed_at":"2026-08-06T19:53:18.329048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:17.955367Z","title":"Hornet: Efficient high- order spatial interactions with recursive gated convolutions","venue":null,"work_id":"5c45b7c1-1e3b-457b-abea-f758ad3d829d","year":2022},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.440665Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:bf54fd5fdea6691d40be2c7036c9ad37a283cf21dcc530afd1dc74900d644fbb","observation_id":"5a228dbd-265a-4465-ac0c-087fc790dca3","resolution":{"observed_at":"2026-08-06T19:53:18.048395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:17.667602Z","title":"Mvx- net: Multimodal voxelnet for 3d object detection","venue":null,"work_id":"328df797-d1f1-4887-bf16-6e1795205db2","year":2019},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.547267Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:717b03f7e5f334d53e0cef487d1f345f4938b0702706dd9460c9b8a255d5f1fd","observation_id":"858f5c2a-29cf-41aa-acdd-59fbe1c38feb","resolution":{"observed_at":"2026-08-06T19:53:17.850304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:17.416514Z","title":"Programming the hilbert curve","venue":null,"work_id":"bda8b8b1-9c2c-4879-b96b-d0e571e20629","year":2004},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.612548Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:42b14f7a085290fbb46db33f3dfa325922b6085d25090509e356c1c96f117b29","observation_id":"9debfaba-96c8-4afb-960d-7a1280d96484","resolution":{"observed_at":"2026-08-06T19:53:17.545273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:17.051284Z","title":"Cyclical learning rates for training neural networks","venue":null,"work_id":"4b389eb0-353e-4db7-982a-19f5dd5a1e2b","year":2017},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.726858Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:26d6080d0a658d8734f51718719a564014f80c545d6bde78ebdb5ad5f13634b8","observation_id":"da679020-337a-40fb-bbb8-0dede8ebf506","resolution":{"observed_at":"2026-08-06T19:53:17.201564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:16.763003Z","title":"Scalability in perception for autonomous driving: Waymo open dataset","venue":null,"work_id":"18fcce6c-dd49-498f-b129-12905b8a8c9f","year":2020},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.796132Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:4a0137b45d22ff10cf06b14365230895ea32cbb3eeb5a818ef8a5b65a6024512","observation_id":"7eb870da-14c1-4359-9d7b-25cea815a329","resolution":{"observed_at":"2026-08-06T19:53:16.901016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08621","last_updated":"2023-08-09T08:53:08Z","snapshot_observed_at":"2026-08-02T13:21:32.251959Z","submitted_at":"2023-07-17T16:40:01Z","title":"Retentive Network: A Successor to Transformer for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08621","snapshot_observed_at":"2026-08-06T19:53:12.898689Z","title":"Retentive network: A successor to transformer for large language mod- els","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.898689Z"},"links":{"cited_paper":"/paper/2307.08621","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:d9106208c6776aa498691dd66395ab2066b1452892235dcd4b1ad9ffdc6d886b","observation_id":"317ce2e2-864a-4ff1-bf14-881f6edc1828","resolution":{"observed_at":"2026-08-06T19:53:12.898689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:12.972858Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.972858Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:a4cca0e91881ddbab96247a27422544eb7e4f221e57cb9ae165e97d305a83f0b","observation_id":"59d8c326-729c-40bc-86bf-bc6a0c18e512","resolution":{"observed_at":"2026-08-06T19:53:12.972858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:16.399252Z","title":"Pointpainting: Sequential fusion for 3d object detec- tion","venue":null,"work_id":"1e0349c6-606a-4b2b-8324-735ceea4ebfd","year":2020},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:13.066313Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:56bd4bcbee981ade13e430e88a8901a538c3ac18c1e05b1424fa7bc9ca7a0f6e","observation_id":"ef5e7103-c48d-4217-b0ee-3ce67db8b73e","resolution":{"observed_at":"2026-08-06T19:53:16.563580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:16.082233Z","title":"Pointaugmenting: Cross-modal augmentation for 3d object detection","venue":null,"work_id":"5a92744b-b557-46fb-a283-9cf0458f87f8","year":2021},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:13.214717Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:0283259bf07a821e81ac76219d3491004d3078bdda0a3ea0d9e9224819352bcf","observation_id":"f8d501d3-dabd-4825-9681-7965ca879f8d","resolution":{"observed_at":"2026-08-06T19:53:16.239092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.805028Z","title":"Unitr: A unified and efficient multi-modal transformer for bird’s-eye-view repre- sentation","venue":null,"work_id":"702d66f4-da76-44e7-85ae-9a6bab0a7c8f","year":2023},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:13.289547Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:abc5134171f53249644153b8bbd289be8ea232a80682297c2c38a3efa68dcb90","observation_id":"06b85570-8dcb-4cb2-bb8d-37d5ba7ec5da","resolution":{"observed_at":"2026-08-06T19:53:15.923502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.768891Z","title":"Fcos3d: Fully convolutional one-stage monocular 3d object detection","venue":null,"work_id":"4e5af2c4-b699-4743-bbe9-25edc97e8367","year":2021},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:13.369423Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:14ac5d0807839cc77c24d7cfb8458ceaac8a5ae6b5dfec19c5d1090e44cd8155","observation_id":"32562089-f54a-4211-974f-4c55a113e51c","resolution":{"observed_at":"2026-08-06T19:53:15.795826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.657901Z","title":"Detr3d: 3d object detection from multi-view images via 3d-to-2d queries","venue":null,"work_id":"580d514a-1e34-46e6-ba43-b3cb5e993af4","year":2022},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:13.466501Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:7f1c2c035448fc7422b5769158b14439d74391f5bfbf5fceb182f6cc2ad4d570","observation_id":"08f7e123-d1bb-4518-8aac-fa82a448f49a","resolution":{"observed_at":"2026-08-06T19:53:15.705069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.01283","last_updated":"2023-09-18T09:53:25Z","snapshot_observed_at":"2026-07-06T14:37:09.104197Z","submitted_at":"2023-01-03T18:36:52Z","title":"Cross Modal Transformer: Towards Fast and Robust 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.01283","snapshot_observed_at":"2026-08-06T19:53:13.556322Z","title":"Cross modal transformer via coordinates encoding for 3d object dectection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:13.556322Z"},"links":{"cited_paper":"/paper/2301.01283","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:662c54d0c08de3a18441b2d7909d6ea878278fc18426dc5c5f66b2fad172e004","observation_id":"fbb415a7-183c-459f-b530-3cc0e4b2e323","resolution":{"observed_at":"2026-08-06T19:53:13.556322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.565140Z","title":"Deepinteraction: 3d object detection via modality interaction","venue":null,"work_id":"15b8bb8e-7ee9-4363-a4ab-df1eec631438","year":1992},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:13.690171Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:a8ded9e84bc9a9d4a87b59d15ca960881b45e6bbf1eb4da7445cae799b4d19c7","observation_id":"b51d058b-fca2-428c-b25b-9ceb366b5b2c","resolution":{"observed_at":"2026-08-06T19:53:15.609300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01006","last_updated":"2023-08-14T08:28:32Z","snapshot_observed_at":"2026-08-05T17:52:33.047601Z","submitted_at":"2023-08-02T08:29:44Z","title":"FusionAD: Multi-modality Fusion for Prediction and Planning Tasks of Autonomous Driving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01006","snapshot_observed_at":"2026-08-06T19:53:13.765739Z","title":"Fusionad: Multi-modality fusion for prediction and planning tasks of autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:13.765739Z"},"links":{"cited_paper":"/paper/2308.01006","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:ee6b1aa1ac38da6d5d1a5dcf68edc5a7cd610c55d639f7fae3811a75d5eed085","observation_id":"9c9e472f-a513-465d-8822-e336663b1030","resolution":{"observed_at":"2026-08-06T19:53:13.765739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.457456Z","title":"Is-fusion: Instance-scene collaborative fusion for multimodal 3d object detection","venue":null,"work_id":"1da8d524-5537-44cd-9af1-02bd37adf678","year":2024},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:13.867817Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:d649a9a2cd9860c5722ddc267f42923293c0b8cf4fc506c2c881b5b5a166925d","observation_id":"77982ee5-4dbc-4c28-841a-b15030ccf595","resolution":{"observed_at":"2026-08-06T19:53:15.515579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.353681Z","title":"Multi- modal virtual point 3d detection.NeurIPS, 34:16494–16507,","venue":null,"work_id":"0ff9bfd6-80bc-4c48-b83a-d31b9e9ee0f7","year":null},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:13.938984Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:fd7605c6205b8cdfc2961fedd69bcaba6884c18093f89c17208a752faf45ec10","observation_id":"275af9c4-d8d0-46b8-b033-5515eea78abc","resolution":{"observed_at":"2026-08-06T19:53:15.407002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03601","last_updated":"2024-08-14T04:31:32Z","snapshot_observed_at":"2026-08-03T08:33:00.534249Z","submitted_at":"2024-08-07T07:41:01Z","title":"DRAMA: An Efficient End-to-end Motion Planner for Autonomous Driving with Mamba","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03601","snapshot_observed_at":"2026-08-06T19:53:14.040375Z","title":"Drama: An efficient end-to-end motion planner for autonomous driving with mamba","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:14.040375Z"},"links":{"cited_paper":"/paper/2408.03601","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:65f6d133ef4d747272a06fd580540bc1ee0042eac1d0065df2cf6ab4b927cfca","observation_id":"54c60ee1-ef19-4de8-9136-d2e0a4122abc","resolution":{"observed_at":"2026-08-06T19:53:14.040375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10700","last_updated":"2024-06-18T17:49:56Z","snapshot_observed_at":"2026-07-06T18:31:32.118399Z","submitted_at":"2024-06-15T17:45:07Z","title":"Voxel Mamba: Group-Free State Space Models for Point Cloud based 3D Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10700","snapshot_observed_at":"2026-08-06T19:53:14.138432Z","title":"V oxel mamba: Group-free state space models for point cloud based 3d object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:14.138432Z"},"links":{"cited_paper":"/paper/2406.10700","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:8af23f1707c9b951cde86f6e560a92eff71ba02c038a0ce2607d80645db45eb6","observation_id":"ecb23d19-0ebd-4b5f-b904-421e009781ce","resolution":{"observed_at":"2026-08-06T19:53:14.138432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.260746Z","title":"Sparselif: High-performance sparse lidar- camera fusion for 3d object detection","venue":null,"work_id":"21f442b2-98ac-4159-af2f-c77db674ad75","year":null},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:14.233935Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:3227971c648a9263281411e2d6427c0c1ca8590b7ee227326f5016ab4905b14b","observation_id":"39a813a2-b4c6-4226-b0ad-12d31d7c576a","resolution":{"observed_at":"2026-08-06T19:53:15.304703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00762","last_updated":"2024-10-11T07:27:00Z","snapshot_observed_at":"2026-07-06T17:38:13.688025Z","submitted_at":"2024-03-01T18:59:03Z","title":"Point Cloud Mamba: Point Cloud Learning via State Space Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00762","snapshot_observed_at":"2026-08-06T19:53:14.470889Z","title":"Point could mamba: Point cloud learning via state space model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:14.470889Z"},"links":{"cited_paper":"/paper/2403.00762","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:60e9c185c942b231c082b77ce1faf4d7b41a107b5ef6e99b6f6be941f50aee70","observation_id":"b412c986-ac72-4a6c-9323-97ddea2df1e3","resolution":{"observed_at":"2026-08-06T19:53:14.470889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.051817Z","title":"Sparsefusion: Dis- tilling view-conditioned diffusion for 3d reconstruction","venue":null,"work_id":"0721a9e2-4cd5-492b-865f-9e17545247db","year":2023},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:14.565845Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:4ae86be0e05085f046536aa12133e72d4b50480dcccc2f1017db5471f9132590","observation_id":"552b7e19-2e9c-4b02-afdb-ec8f73d3b8ad","resolution":{"observed_at":"2026-08-06T19:53:15.102869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09417","last_updated":"2024-11-14T02:00:33Z","snapshot_observed_at":"2026-07-06T17:16:59.193820Z","submitted_at":"2024-01-17T18:56:18Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09417","snapshot_observed_at":"2026-08-06T19:53:14.633463Z","title":"Vision mamba: Efficient visual representation learning with bidirectional state space model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:14.633463Z"},"links":{"cited_paper":"/paper/2401.09417","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:82af2fefa37a33160fb736b4f3cc7e580a41000941eae2ef0616d8b5b68cd71c","observation_id":"1912f903-9a5e-4027-8bdd-1894ac35ae8c","resolution":{"observed_at":"2026-08-06T19:53:14.633463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06832","last_updated":"2025-06-30T13:55:41Z","snapshot_observed_at":"2026-07-06T19:00:09.034268Z","submitted_at":"2024-08-13T11:46:32Z","title":"FlatFusion: Delving into Details of Sparse Transformer-based Camera-LiDAR Fusion for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06832","snapshot_observed_at":"2026-08-06T19:53:14.686363Z","title":"Flatfusion: Delving into details of sparse transformer-based camera-lidar fusion for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:14.686363Z"},"links":{"cited_paper":"/paper/2408.06832","citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:f32845433cc6ec739fdcb9a1da5564ad76cacfbe65d1851e8f1062ccd50c052b","observation_id":"2c1476b1-5909-4e7a-9d00-cb6c438fe38c","resolution":{"observed_at":"2026-08-06T19:53:14.686363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.154821Z","title":null,"venue":null,"work_id":"3cb7b456-cccf-42b7-b5be-b86e828d8dab","year":2025},"citing_paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection","version":1},"reference_index":128,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:14.364104Z"},"links":{"citing_paper":"/paper/2507.04369"},"observation_digest":"sha256:909935b65bc79b6351b9358a13227777bfa672f06e62de18511b0d4900bcf393","observation_id":"945e92ee-c99c-4ea2-99fe-1b23910035df","resolution":{"observed_at":"2026-08-06T19:53:15.207031Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.04369","last_updated":"2025-07-06T12:29:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T19:47:01.141849Z","submitted_at":"2025-07-06T12:29:45Z","title":"MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":21,"verified_exact":1,"verified_fuzzy":39},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 1 inbound Pith citation observation for arXiv:2507.04369."}