{"as_of":"2026-08-18T10:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3dd2f32379288c1c433b07910f3c182d1ddab060c6543f62c78dcf206fb528fc","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:10:11.965820Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.16368/citation-record","integrity":"/paper/2504.16368/integrity","json":"/paper/2504.16368/citation-record.json","paper":"/paper/2504.16368"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-08-17T05:15:58.663240Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-16T11:10:11.563799Z","title":"Bevdet: High- performance multi-camera 3d object detection in bird-eye-view,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.563799Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:3857066915397c394c53bb02bbb051c56c68b3dc8d5096c42f2b7921abc3937a","observation_id":"6932ac3c-a27f-4c57-b005-db252a89ff9b","resolution":{"observed_at":"2026-08-16T11:10:11.563799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.569710Z","title":"Petr: Position embedding trans- formation for multi-view 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.569710Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:cb78b427c5a72ed4cf053675716da8b9d09dda696f4ab2354f12ecb32e620404","observation_id":"0b39b755-21a8-4f2e-ac79-967ea930fe12","resolution":{"observed_at":"2026-08-16T11:10:11.569710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.574493Z","title":"Exploring object- centric temporal modeling for efficient multi-view 3d object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.574493Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:becfc97278b586c398c966d087e9da360f38e6df3836934f1b9f78fd47cfdb13","observation_id":"a2795354-6e70-4262-83c1-b8dd491ad0ba","resolution":{"observed_at":"2026-08-16T11:10:11.574493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.579425Z","title":"Bevnext: Reviving dense bev frameworks for 3d object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.579425Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:f1ccde3c6d5dc6dba0986f1b5ab01c914e2f12e650174581901fcb82c7511af1","observation_id":"608815c1-c9d7-450f-adf0-89f74f2536c9","resolution":{"observed_at":"2026-08-16T11:10:11.579425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.653685Z","title":"3dppe: 3d point positional encoding for transformer-based multi-camera 3d object detection,","venue":null,"work_id":"ebb4d3cc-68c2-4922-b45b-06299bd1fd28","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.584766Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:167670b63a8c32a731e28a48e662a55374fe7b816c419332d4162a62c7a1db3e","observation_id":"a1060b77-1c01-4113-bdd6-c2465f10924c","resolution":{"observed_at":"2026-08-16T11:10:12.659816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.638622Z","title":"Graph-detr4d: Spatio-temporal graph modeling for multi-view 3d object detection,","venue":null,"work_id":"f549fff9-cdfe-4e47-900d-ea614649313a","year":2024},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.590007Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:9de2ac683c8a97f69fbf965f45fd128b244bb2365d7f130efb6fe079727bd6b0","observation_id":"9ddd5857-d8f5-4dbc-b005-aa487ff8112e","resolution":{"observed_at":"2026-08-16T11:10:12.643347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07746","last_updated":"2025-03-26T08:48:13Z","snapshot_observed_at":"2026-08-17T23:34:41.690892Z","submitted_at":"2024-03-12T15:28:51Z","title":"Unleashing HyDRa: Hybrid Fusion, Depth Consistency and Radar for Unified 3D Perception","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07746","snapshot_observed_at":"2026-08-16T11:10:11.595180Z","title":"Unleashing hydra: Hybrid fusion, depth consistency and radar for unified 3d perception,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.595180Z"},"links":{"cited_paper":"/paper/2403.07746","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:bcc487c1ec3b06847dc684d5b42f10cb87f96d29eb76e369a7a3537ad9466485","observation_id":"374ee0f6-d961-425c-ad2d-5b75b8b95bb5","resolution":{"observed_at":"2026-08-16T11:10:11.595180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.623596Z","title":"Rcbevdet: Radar-camera fusion in bird’s eye view for 3d object detection,","venue":null,"work_id":"d8f14abf-dccc-4d1a-b1bc-02d9dbc74553","year":2024},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.600582Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:fce4a26688b478198654f9241bf922ab5b072560eb6e590b523d227a7942fb8d","observation_id":"719da30e-e249-445d-abf5-5fed127b7943","resolution":{"observed_at":"2026-08-16T11:10:12.628408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.609797Z","title":"Futr3d: A unified sensor fusion framework for 3d detection,","venue":null,"work_id":"4d4c21d3-3699-4426-9491-e53c5d4e24d2","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.605227Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:c4e8c6d52c69db66366fa9fcaf14024ae82e2f197b9d6e99e86d364b8254656b","observation_id":"b7e1327a-6870-46ec-8b7c-85bbe8c0c2d8","resolution":{"observed_at":"2026-08-16T11:10:12.614054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.597151Z","title":"Sparsefusion3d: Sparse sensor fusion for 3d object detection by radar and camera in environmental perception,","venue":null,"work_id":"9027cce7-1f06-4792-b34c-593e9cdbc515","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.609927Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:4ad25086f04a50287fa562a4f94317e4c4affdf68002d4277f0553a9135a96a4","observation_id":"be43606f-3930-4ee7-a707-46c80562fea8","resolution":{"observed_at":"2026-08-16T11:10:12.601254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.582908Z","title":"Crn: Camera radar net for accurate, robust, efficient 3d perception,","venue":null,"work_id":"407ff011-f99c-4cdb-bec5-376ab85164e8","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.614449Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:7cce0362a950a7d52374e6fea7d445e7d5bf699d1398978971fc651076f574c7","observation_id":"e3837ed6-ea59-46cc-811f-3452d3f7014c","resolution":{"observed_at":"2026-08-16T11:10:12.587405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-08-13T17:54:01.724774Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-16T11:10:11.618897Z","title":"Deformable detr: Deformable transformers for end-to-end object detection,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.618897Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:9889b93a033901e9ac2798b720021ca4a6d77507183a050778e5e5dfd83d8ece","observation_id":"6738784e-cf37-426c-b01c-96c9a7ca8dc4","resolution":{"observed_at":"2026-08-16T11:10:11.618897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.624442Z","title":"Fcos3d: Fully convolutional one- stage monocular 3d object detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.624442Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:6412c3deb0ab547dd523e58aba0eb97592ecafc0f1e8aaefac101ee0c6848786","observation_id":"47a2a1ae-78e5-4923-8896-2e7b7015fa6d","resolution":{"observed_at":"2026-08-16T11:10:11.624442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.07850","last_updated":"2019-04-25T16:20:02Z","snapshot_observed_at":"2026-08-14T16:45:31.678245Z","submitted_at":"2019-04-16T17:54:26Z","title":"Objects as Points","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.07850","snapshot_observed_at":"2026-08-16T11:10:11.628928Z","title":"Objects as points,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.628928Z"},"links":{"cited_paper":"/paper/1904.07850","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:37a6d9198482a97941a7d9c3edd361676022ece1fa230113f5b8170fbbd363a6","observation_id":"59e69699-816a-4ada-8e4f-c0cb479b002d","resolution":{"observed_at":"2026-08-16T11:10:11.628928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.559615Z","title":"Progressive coordinate transforms for monocular 3d object detection,","venue":null,"work_id":"c2bd0987-a722-453c-926b-b6770f601908","year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.633728Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:70c11c21e9c5481b246c24e13ce2f29bb54d848114b5c423a302686bd1982f4d","observation_id":"28546750-89b1-4489-8456-7a1cde35a836","resolution":{"observed_at":"2026-08-16T11:10:12.564609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.638094Z","title":"Stereoscopic vision recalling memory for monocular 3d object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.638094Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:b10a045947f0a8b8a36fb19bd6cd35fa6c8efffd70863f3ec8c9998484196148","observation_id":"372d58f1-cf01-45ba-8bf7-eeea65e8205d","resolution":{"observed_at":"2026-08-16T11:10:11.638094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.537360Z","title":"Obmo: One bounding box multiple objects for monocular 3d object detection,","venue":null,"work_id":"cd78fb20-9cc6-4b07-8d8f-5fbb0f6a3674","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.642571Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:e244347552401cfaa4dd1e961a83eb71ec664d9f829284eef3ecca527d6ff4c3","observation_id":"1a102649-3c91-4ae1-934e-a777835f0d0d","resolution":{"observed_at":"2026-08-16T11:10:12.541875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.522669Z","title":"Query-based temporal fusion with explicit motion for 3d object detection,","venue":null,"work_id":"2e767889-f47d-400e-a189-ad5899bb4ae0","year":2024},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.647474Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:973da6066e1fc0ed52995bbc6dba84fb4e8e9c17d607801957ee48825e43b7ec","observation_id":"21e86fde-3e67-41b3-93f2-142d7a2cb32f","resolution":{"observed_at":"2026-08-16T11:10:12.527225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.651853Z","title":"Detr3d: 3d object detection from multi-view images via 3d-to-2d queries,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.651853Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:b1bb7833809ddd97a67cb4c5a46bd6839c6738470b4e646c0d14ec01cdb1cbbf","observation_id":"05711bc7-5eba-4e8e-9c6b-8ef74ca0250d","resolution":{"observed_at":"2026-08-16T11:10:11.651853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.657045Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.657045Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:2de7dc2a0a1bdf8c9584ba7ea58e55f746395bdeb35707248fc0f64e1da2b663","observation_id":"ed5156df-4d18-4e45-bacc-4073e455188a","resolution":{"observed_at":"2026-08-16T11:10:11.657045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.662174Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detec- tion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.662174Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:97e4b96fbbe487e1950a93949935f98d3159dc82fb8c98d0311159ec72157189","observation_id":"17eddc5e-8408-471e-b277-391cbf62b76b","resolution":{"observed_at":"2026-08-16T11:10:11.662174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.666865Z","title":"Bevformer v2: Adapting modern image backbones to bird’s-eye-view recognition via perspective supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.666865Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:7baffd60c2012abaa2a69e96d413b1bc6bc7d4b1fd31e09c51630d76cfafe83c","observation_id":"719cc0e6-23b0-454e-8a38-2dc6fe8bcc00","resolution":{"observed_at":"2026-08-16T11:10:11.666865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05088","last_updated":"2022-04-19T05:40:19Z","snapshot_observed_at":"2026-08-16T17:07:47.661183Z","submitted_at":"2022-04-11T13:43:25Z","title":"M$^2$BEV: Multi-Camera Joint 3D Detection and Segmentation with Unified Birds-Eye View Representation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05088","snapshot_observed_at":"2026-08-16T11:10:11.671588Z","title":"M 2 bev: Multi-camera joint 3d detection and segmentation with unified birds-eye view representation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.671588Z"},"links":{"cited_paper":"/paper/2204.05088","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:78f4e5350f6ec83012f373babbbf1a26daedaeec518e2ebbf20866a22712b7ca","observation_id":"4f954abe-9508-48d6-9e3d-47cade9fbe52","resolution":{"observed_at":"2026-08-16T11:10:11.671588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.676387Z","title":"Bevstereo: Enhancing depth estimation in multi-view 3d object detection with temporal stereo,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.676387Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:16aa7aed4323ed76d8e7e75883a16f578aa6077db3cd76b561e66b57e9961811","observation_id":"2209f5f1-e9de-41fc-b613-883b96aa87f5","resolution":{"observed_at":"2026-08-16T11:10:11.676387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.463362Z","title":"Cobev: Elevating roadside 3d object detection with depth and height complementarity,","venue":null,"work_id":"bc7e4158-4470-4242-a1ac-e954947e920d","year":2024},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.681005Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:5a8f199895b114cae10984314d0a1eb1d901e1a0e0ed73afd46c1e44d55e3bba","observation_id":"699226f6-8b8e-4314-8351-83d1c3a02d45","resolution":{"observed_at":"2026-08-16T11:10:12.468617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-16T16:14:57.237141Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-16T11:10:11.686107Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.686107Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:949db383212727af0ed27971b2d53d6065714bcc78b089774fa92bd5400a57c0","observation_id":"6314db29-6e46-44ae-8cf6-e0c4bb7a1304","resolution":{"observed_at":"2026-08-16T11:10:11.686107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.690982Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unprojecting to 3d,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.690982Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:824a3e65c6ff1400cecd985a92c5261aa4807ecbeb614ce9b3bea4305d78ca6a","observation_id":"0c41ffcc-f359-4302-b76f-21a35d2500fe","resolution":{"observed_at":"2026-08-16T11:10:11.690982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-08-16T17:10:15.129652Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-16T11:10:11.697015Z","title":"Bevdet4d: Exploit temporal cues in multi- camera 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.697015Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:c376581ac35705288f99018732dc66deb3113adb8dc91988e1c6d641e6af15a0","observation_id":"1fb64b7a-eca9-4069-9f8e-931fb31fd0f9","resolution":{"observed_at":"2026-08-16T11:10:11.697015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.17111","last_updated":"2022-11-30T15:55:38Z","snapshot_observed_at":"2026-08-16T16:12:02.651675Z","submitted_at":"2022-11-30T15:55:38Z","title":"BEVPoolv2: A Cutting-edge Implementation of BEVDet Toward Deployment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.17111","snapshot_observed_at":"2026-08-16T11:10:11.701804Z","title":"Bevpoolv2: A cutting-edge implementation of bevdet toward deployment,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.701804Z"},"links":{"cited_paper":"/paper/2211.17111","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:744b3ab923dd2f1972e69ba9781635ef3a100fa5ecaab6579c94bd8be71bf8f2","observation_id":"bf4adc1d-236f-44fe-8ec6-4ccce05eec3c","resolution":{"observed_at":"2026-08-16T11:10:11.701804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.439864Z","title":"Centerfusion: Center-based radar and camera fusion for 3d object detection,","venue":null,"work_id":"137b8940-8f3e-4a5d-85f1-ea761fe2869d","year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.706410Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:a1b64dace96902aafaec7e004202155d8c6c85298becfd4e58c1b15e5ecb23b4","observation_id":"10dd0b13-504f-46fd-b5b0-3a4d07a2c7ba","resolution":{"observed_at":"2026-08-16T11:10:12.444240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.426276Z","title":"Radiant: Radar-image association network for 3d object detection,","venue":null,"work_id":"4c6c3521-c253-41e9-9589-b6624b24b4b1","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.710940Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:0834579d0a20a557e55310d4461afa9bb5c68afd0050af40ac92257ee21f0992","observation_id":"7f9be76c-e5c7-4a56-8502-1a92982876c1","resolution":{"observed_at":"2026-08-16T11:10:12.430737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.412665Z","title":"Craft: Camera-radar 3d object detection with spatio-contextual fusion transformer,","venue":null,"work_id":"37eb403c-e718-4de2-8078-23b8d75b0178","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.715658Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:d51df2ad030943114668ca6aa1998d6c08bf795bf542370cfefd7368e88b25df","observation_id":"eedd766c-0d87-4037-b369-f96d441a2152","resolution":{"observed_at":"2026-08-16T11:10:12.417087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.399317Z","title":"Mvfusion: Multi-view 3d object detection with semantic-aligned radar and camera fusion,","venue":null,"work_id":"859debc5-3f54-4bdb-9a90-6f9014100d1b","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.719977Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:92333b9b29bbee30fa79d8998c8d584bc3c695b4c2f60a2348f2ff7cb7e5ef7c","observation_id":"4dd96728-f01f-40de-a65e-063689c61e38","resolution":{"observed_at":"2026-08-16T11:10:12.403745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.725049Z","title":"Dimensionality reduction by learning an invariant mapping,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.725049Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:7d84813b85b2534394121ea62acd7937d136ba52cca89d51d494e9a52afca170","observation_id":"24646509-724d-4328-9946-ebabe5ea4fa6","resolution":{"observed_at":"2026-08-16T11:10:11.725049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.860697Z","title":"Momentum contrast for unsupervised visual representation learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.860697Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:b2366b6da10d719813eb76cdff4bdc202d362288c08f43ca41a7e5843ef3de3c","observation_id":"1fd1a261-93bd-4dfb-8da5-5afb37f62e8e","resolution":{"observed_at":"2026-08-16T11:10:11.860697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.866028Z","title":"A simple framework for contrastive learning of visual representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.866028Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:12bfc6f42427426866fc17160703f8c024b18c5d61f6de26d90647042161a296","observation_id":"1f22a881-51d6-4100-9d82-3b5c7ea8947e","resolution":{"observed_at":"2026-08-16T11:10:11.866028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.358185Z","title":"Aligning pretraining for detection via object-level contrastive learning,","venue":null,"work_id":"4b7ae697-6ec8-4bcf-b42c-5ba671827379","year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.870513Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:ef1a6e5c8e3193f224511e77ca8d69fed447e477bb1acc9d5627a3474e478c1f","observation_id":"ab57de51-29f0-498b-b18f-f3db791022fb","resolution":{"observed_at":"2026-08-16T11:10:12.362659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.343638Z","title":"Fsce: Few-shot object detection via contrastive proposal encoding,","venue":null,"work_id":"a08ed69b-174a-486c-b347-70956a6de383","year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.874471Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:49799beaed7ffe2331af75899a37ec026201a6b3fc9c68580845cf24783a0e6b","observation_id":"c2bbca37-e14a-40fc-a5ce-4f9e2e076990","resolution":{"observed_at":"2026-08-16T11:10:12.348164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.878980Z","title":"Cat-det: Contrastively augmented transformer for multi-modal 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.878980Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:86525de4b47998af8f6f3b86663813f2699ceecb95cf95d1930b6af482d30eb1","observation_id":"f482d8c1-b2d1-4cdf-862f-a6dceba117c1","resolution":{"observed_at":"2026-08-16T11:10:11.878980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.882751Z","title":"Feature pyramid networks for object detection,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.882751Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:a792eda5c69f9a554cfe294936dd4d8f24c5379b2c3cd17e7423b06960b30703","observation_id":"00f03197-22b7-42eb-8d2b-d910ee8a118e","resolution":{"observed_at":"2026-08-16T11:10:11.882751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.886529Z","title":"Pointpillars: Fast encoders for object detection from point clouds,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.886529Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:e3264ee7cc7ec42400d041b3e38cf95d9055091c0e1768f2e861a0032b203063","observation_id":"08a4b010-8d75-4c5a-a602-487ff412a90e","resolution":{"observed_at":"2026-08-16T11:10:11.886529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.890802Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.890802Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:873ad20659a8a9788e606767a619aad23c23de6a1a62021494503a9d314d1f27","observation_id":"22864e52-6320-4d24-8176-929239c0e731","resolution":{"observed_at":"2026-08-16T11:10:11.890802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.895497Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.895497Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:178bf676a3c6598f20fcf8abb72441a03c564f3c2b97a7ead7881003d8e7c95d","observation_id":"f931482d-8137-4871-bcb9-35c0f0435a3e","resolution":{"observed_at":"2026-08-16T11:10:11.895497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.900105Z","title":"Rectified linear units improve restricted boltz- mann machines,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.900105Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:dd1cbaa02633a20ff070413f8952f97b50b41a480f8203aa92a108c0dfa37b0a","observation_id":"2c9be7f8-37fa-459e-8f6b-5b0ebe4536f1","resolution":{"observed_at":"2026-08-16T11:10:11.900105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-16T11:10:11.904424Z","title":"Distilling the knowledge in a neural network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.904424Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:8183f009c94a92305897703b5d5a3c1614a610290e28777f401d39f859e2da65","observation_id":"d776a076-027d-4636-9d74-a226f8e96dbf","resolution":{"observed_at":"2026-08-16T11:10:11.904424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.275428Z","title":"Time will tell: New outlooks and a baseline for temporal multi-view 3d object detection,","venue":null,"work_id":"d20f3338-5401-47f3-a2ba-191459905dcb","year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.908876Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:50f717dee0beeaad57f2cdc484dcfcfbc8160fdba6be1504b372c07dfcb2cf41","observation_id":"ec2281ef-a251-453f-861f-fbfe881d4e74","resolution":{"observed_at":"2026-08-16T11:10:12.281172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.913075Z","title":"Sparsebev: High- performance sparse 3d object detection from multi-camera videos,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.913075Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:1e97730475d327e9aa78e68130ed5342003a5e5fb52731df6a0d36da03193531","observation_id":"2d35f54b-d56f-4ed7-a870-0a6476442e2b","resolution":{"observed_at":"2026-08-16T11:10:11.913075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.252671Z","title":"Bridging the view disparity between radar and camera features for multi-modal fusion 3d object detection,","venue":null,"work_id":"5aad9ded-3a25-4468-9b9f-72140974ab25","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.916829Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:2fba95d97df6e2a925bf1385810271d68710cb2870a517852249a470778de513","observation_id":"97fa5e9f-0a33-4c8a-8f59-8106e64cd1d3","resolution":{"observed_at":"2026-08-16T11:10:12.257281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.920381Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.920381Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:159cc74e4b485d87391995eaf1ddf7110f6650488988a5684168f416ec55b646","observation_id":"22553127-57c5-4e13-bce9-e23387960a83","resolution":{"observed_at":"2026-08-16T11:10:11.920381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.923971Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.923971Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:eb92472f120ae67f530f7f31a30d776fb786061ad49b1cda6b69ef487415b5ea","observation_id":"45cfbb37-0d35-4652-8f69-02543c9adcc3","resolution":{"observed_at":"2026-08-16T11:10:11.923971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.223575Z","title":"An energy and gpu- computation efficient backbone network for real-time object detection,","venue":null,"work_id":"d21b7e86-5d24-4835-b0b4-2619a802318d","year":2019},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.928187Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:0e60c00f26211099d627aedd081564cbfa74c5e948c2fc81040984a290069a91","observation_id":"a7c59733-f344-4c03-b033-e6aed0b003d3","resolution":{"observed_at":"2026-08-16T11:10:12.227397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.933101Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.933101Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:0669f12054df07924858c443e87c042bf6c3f9f451c21d68d2e8957b51545407","observation_id":"6698b2b1-8a88-4070-bd9e-c825795bf7c0","resolution":{"observed_at":"2026-08-16T11:10:11.933101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.937587Z","title":"Is pseudo- lidar needed for monocular 3d object detection?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.937587Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:2c5f5d60696d0e5a36dc39b726ec97c287b3038fc90291443c2258033e55c823","observation_id":"b6aeab33-294a-443a-bcef-fe9d9739e38b","resolution":{"observed_at":"2026-08-16T11:10:11.937587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.193159Z","title":"Focal-petr: Embracing foreground for efficient multi-camera 3d object detection,","venue":null,"work_id":"2fc17838-4ccf-4f99-8d94-38437b120c32","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.941580Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:f3fa33634a95e27cc64900ba3be4a2d0e9c008d59f106bc1e5d8863c49f8dbe7","observation_id":"e40ee12f-838c-4d7e-9823-c684c9be94e0","resolution":{"observed_at":"2026-08-16T11:10:12.197756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.945629Z","title":"Dn-detr: Accelerate detr training by introducing query denoising,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.945629Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:3cc59ebe7d47139a699f391d0581c8ec85a2d882c9523d60701ce1dea2bcf8ef","observation_id":"ecc60190-563f-4c4b-98ad-9155e95c3a88","resolution":{"observed_at":"2026-08-16T11:10:11.945629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.09492","last_updated":"2019-08-26T06:27:01Z","snapshot_observed_at":"2026-08-14T21:44:27.735473Z","submitted_at":"2019-08-26T06:27:01Z","title":"Class-balanced Grouping and Sampling for Point Cloud 3D Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.09492","snapshot_observed_at":"2026-08-16T11:10:11.949681Z","title":"Class-balanced grouping and sampling for point cloud 3d object detection,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.949681Z"},"links":{"cited_paper":"/paper/1908.09492","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:a667639155db6ae73438070128e7b33483c4a52c88531342349f31b2ff2d057b","observation_id":"c9189eca-c5f8-450d-8e2d-0d89e4142ecd","resolution":{"observed_at":"2026-08-16T11:10:11.949681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-16T11:10:11.954037Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.954037Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:e3b070b78d4b77ae7a11fb527215b73789eee2f54de6cb1e5587f812303abcc4","observation_id":"6c2e6a38-efa6-472e-b5ae-57642558e37a","resolution":{"observed_at":"2026-08-16T11:10:11.954037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.958270Z","title":"Petrv2: A unified framework for 3d perception from multi-camera images,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.958270Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:b76effc7776644e1a7b5c19f99151602fb3d64c1de81e5f267af094195ba00b2","observation_id":"c7c6a263-05d9-47b8-857a-042d36ab2f78","resolution":{"observed_at":"2026-08-16T11:10:11.958270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.159369Z","title":"Unifying voxel- based representation with transformer for 3d object detection,","venue":null,"work_id":"22d1b057-d1dc-46ea-b98a-7f3e72d3e787","year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.961752Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:d925e6d3701b73c6c9b781fef445ea3534ba4336f01d4f335f80c78c81f3ba57","observation_id":"7e26c791-4f02-4395-ac92-0e9dc6bb71b7","resolution":{"observed_at":"2026-08-16T11:10:12.165825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.965820Z","title":"Pointnet++: Deep hierarchical feature learning on point sets in a metric space,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.965820Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:f10d59611013e78fd8b66c1474f420c254280decdd66fe2c2bce8a0e229124fd","observation_id":"6f094a08-0a12-49a8-b5b9-11bbd630bd1b","resolution":{"observed_at":"2026-08-16T11:10:11.965820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T11:00:41.313045Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 0 inbound Pith citation observations for arXiv:2504.16368."}