{"as_of":"2026-08-09T11:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3ad1db343d2975be8e1913461eaa8c55bc9bf770c2e1967306de6740a6d0df41","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T00:40:57.018937Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.31015/citation-record","integrity":"/paper/2606.31015/integrity","json":"/paper/2606.31015/citation-record.json","paper":"/paper/2606.31015"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.976702Z","title":"Faster R-CNN: towards real- time object detection with region proposal networks,","venue":null,"work_id":"10a99c9b-d94c-49c3-967e-c200b54f8b1c","year":2017},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:0645bd01782b9e2302d5107266994d0cebd3a319285bf683289c1ae30fc5efbc","observation_id":"299da5fe-d441-4420-b3ea-c681738df322","resolution":{"observed_at":"2026-07-07T08:23:30.977938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.952257Z","title":"Yolov5 by ultralytics,","venue":null,"work_id":"bd3d101f-12b2-45b4-bd66-0ea4958c8431","year":2020},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:107a8cdaacbd8ca267e0f3fe06bcf30a66efb5a37ac13004e6b7d23cfb67d32a","observation_id":"13793dd7-d66d-4b64-9042-9fa83f6da77b","resolution":{"observed_at":"2026-07-07T08:23:30.953253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.030845Z","title":"Ultralytics yolo,","venue":null,"work_id":"e66a1d74-dba2-419a-b299-4747aa73bfd4","year":2023},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:79c1448bedf048e755064ec8552630166c0f9a60dba88d07c6ccbd91b19dac07","observation_id":"c56c021f-7d5f-4a1c-b918-7fb399bb9aaf","resolution":{"observed_at":"2026-07-07T08:23:31.031816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.985137Z","title":"Yolov10: Real-time end-to-end object detection,","venue":null,"work_id":"f65f5673-28d6-4df4-8f39-3102c7cce59c","year":2024},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:47afeaca81c9da928f38bfb9d91844a521f470b3aa162b41dbeae85f60eb6e19","observation_id":"d33bb750-717e-4393-877a-ac4214279596","resolution":{"observed_at":"2026-07-07T08:23:30.986264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.959568Z","title":"Deformable cross-attention transformer for weakly aligned RGB-T pedestrian detection,","venue":null,"work_id":"d250803d-3d9c-4936-91bb-6d7991dbc8c1","year":2025},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:86d7683d4bde9cdce10182127b0183a1b82d431bd0c60d07c652c95c4ad49065","observation_id":"7ce2a89d-8768-42ce-a38c-ff3ab498ffaa","resolution":{"observed_at":"2026-07-07T08:23:30.960696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.955568Z","title":"Dacfusion: Dual asymmetric cross-attention guided feature fusion for multispectral object detection,","venue":null,"work_id":"b68948b5-16c6-437d-a648-e5ad56fb085a","year":2025},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:1f955bcbf8535e30d5c154dabf7e0f7c4adbddd1fd773afd33078bb0833c59ab","observation_id":"15964b04-4713-44d8-a547-9e92275b351e","resolution":{"observed_at":"2026-07-07T08:23:30.957037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.022266Z","title":"Ei2det: Edge-guided illumination-aware interactive learning for visible-infrared object detec- tion,","venue":null,"work_id":"220aa39d-7c7a-4ebb-89c1-5377a06d29c2","year":2025},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:c6f33d17a529d15d707e89ae131ea22d856c55be0855baa095bf8dbe4dbded12","observation_id":"2055bf3a-849d-48a5-88a8-d1467e08b40a","resolution":{"observed_at":"2026-07-07T08:23:31.023419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.995741Z","title":"Guided attentive feature fusion for multispectral pedestrian detection,","venue":null,"work_id":"554f8bcf-2786-4bdc-a029-16a0c60b5057","year":2021},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:2a002442c2f789072b4966f0435c0703fd08125d76275eae139eced0c3214dd8","observation_id":"c830883e-80c3-4641-848f-3e38779d5811","resolution":{"observed_at":"2026-07-07T08:23:30.996912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.006449Z","title":"Vehicle detection based on adaptive multimodal feature fusion and cross-modal vehicle index using RGB-T images,","venue":null,"work_id":"8f7ecc94-d30a-48e3-b0b3-a6450d76134a","year":2023},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:dead70e28ccb65d518dc3feefb04e6069a32116d026d2b4b997f5de628428b53","observation_id":"2ac3cf02-bcd5-4068-8f7e-8ea084f9dcca","resolution":{"observed_at":"2026-07-07T08:23:31.007639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.994060Z","title":"Cross-modal oriented object detection of UA V aerial images based on image feature,","venue":null,"work_id":"6f275363-b6ae-4bc8-845b-c4f00dbc9427","year":2024},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:532e4311cda9b56f74bb5904bd7fbfda915406a7b8227aae0edf44c28b58682f","observation_id":"d044cd02-d660-48c3-9255-910248f5302d","resolution":{"observed_at":"2026-07-07T08:23:30.995191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00273","last_updated":"2022-10-04T09:52:39Z","snapshot_observed_at":"2026-07-06T12:03:45.415112Z","submitted_at":"2021-10-30T15:34:12Z","title":"Cross-Modality Fusion Transformer for Multispectral Object Detection","version":4},"cited_work":{"arxiv_id":"2111.00273","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.00273","snapshot_observed_at":"2026-07-10T11:37:03.133129Z","title":"Cross-Modality Fusion Transformer for Multispectral Object Detection.arXiv2021","venue":"eess.IV","work_id":"965043fb-2179-4ec0-83bf-20268353d311","year":2021},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"cited_paper":"/paper/2111.00273","citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:bc4694370e13bea3091e216361d0af0aed4037b947eece9e7b395d69b2c689af","observation_id":"d51b53a7-1674-4b97-88c5-0e5c772f988a","resolution":{"observed_at":"2026-07-01T00:45:11.961414Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.997790Z","title":"Crossformer: Cross-guided attention for multi-modal object detection,","venue":null,"work_id":"cec982e4-d0b2-4b97-9e98-20014d9ea848","year":2024},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:ed3b26845beae94133111d2661e226e732bfb3539cff0345df1ced25751e9113","observation_id":"9e33de16-eebd-4fa3-b4cf-d75797fa86c7","resolution":{"observed_at":"2026-07-07T08:23:30.998991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.999557Z","title":"Rich feature hierarchies for accurate object detection and semantic segmentation,","venue":null,"work_id":"e212f1f7-5773-437f-8323-1f9ef58985fb","year":2014},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:0b1518cd7b62af47fe448ea03bf5c4cf2485316940fc66bfa9ce3c68b2e5e7c2","observation_id":"46d1e803-c1d6-4e8c-9342-cdc019640802","resolution":{"observed_at":"2026-07-07T08:23:31.000703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.962850Z","title":"Fast R-CNN,","venue":null,"work_id":"eec1204b-4d89-4307-95ff-9157dbb5b575","year":2015},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:720e9c47e99c136d4897d964686a9e26043bb6c8a8d581810f2b7d088adb39b6","observation_id":"19f60c16-c4b2-40df-be33-1d95094cb8b4","resolution":{"observed_at":"2026-07-07T08:23:30.963837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.965964Z","title":"Mask R-CNN,","venue":null,"work_id":"af27c6da-261b-4644-bca8-8dcdffb4a2bb","year":2020},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:42d48b6de993323d9180c2c1f26f5de3d9af76f94d5ce84905d98fffaaaeade1","observation_id":"e9d8d50c-ad96-4599-9aae-5c515d74cb36","resolution":{"observed_at":"2026-07-07T08:23:30.966997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.015025Z","title":"Improving multispectral pedestrian detection by addressing modality imbalance problems,","venue":null,"work_id":"63bd730f-55a8-4b02-94f8-5ef58d94fdd9","year":2020},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:1f306be84cdb6305f06fbd3eac8cd17a087a0e63f9dbcb88d08d9a9c61a07a1d","observation_id":"179e4104-f14b-4e49-8e85-1f54d5b824b4","resolution":{"observed_at":"2026-07-07T08:23:31.016150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.041028Z","title":"Cross-modality interactive attention network for multispectral pedestrian detection,","venue":null,"work_id":"baa254c2-dd02-4885-afbb-aa9a769fff4c","year":2019},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:23206e3f11c75ca445af0bff2cd00067c51d60cab786fc13074526229ec2b4e0","observation_id":"2c2d478b-cee0-4488-adff-35af4811beaa","resolution":{"observed_at":"2026-07-07T08:23:31.042156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.988520Z","title":"Multimodal object detection by channel switching and spatial attention,","venue":null,"work_id":"f90f2189-faeb-4fc3-81a4-bc9fbd6c5e34","year":2023},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:34bbb56ad5b1d5b27e9beb74a71d463ec34f9ea88103f2ba15e058c8d4d11dad","observation_id":"2b7a287c-58d9-42c5-a47c-9bbf8918c30e","resolution":{"observed_at":"2026-07-07T08:23:30.989828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.981644Z","title":"Superyolo: Super resolution assisted object detection in multimodal remote sensing im- agery,","venue":null,"work_id":"37ad6adf-56a5-4cda-ae64-5090d8ddef73","year":2023},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:cf3b4e069b034a5e4dfaaa468605ba0cb383bc25bc94205e51545f17f1adcc0a","observation_id":"344e63d4-d533-4b3c-8651-89fd979d5831","resolution":{"observed_at":"2026-07-07T08:23:30.982826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.020567Z","title":"Deep cross-modal representation learning and distillation for illumination-invariant pedestrian detection,","venue":null,"work_id":"7583cdb2-8107-415e-96c6-a2cb07540dcc","year":2022},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:4e9e0cf79c6e089cd8a9ae6c42bcce3a12cf7d773a5dc0dcffa94b263019466d","observation_id":"d130abcc-a22b-4c88-8dfe-8f5e3b0b76b2","resolution":{"observed_at":"2026-07-07T08:23:31.021741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.011669Z","title":"Cross-modality com- plementary information fusion for multispectral pedestrian detection,","venue":null,"work_id":"772f67dc-9520-49b9-8b46-0cd8dc89447a","year":2023},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:2efb712adb2eaa3fdebc2bacc9fcbeaad26732315b022567b0b5efd6d579d835","observation_id":"c93ad8b4-6fa1-4ffc-9d5a-71c6a43874e0","resolution":{"observed_at":"2026-07-07T08:23:31.012850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.008204Z","title":"Cross-modality attentive feature fusion for object detection in multispectral remote sensing imagery,","venue":null,"work_id":"18429e73-65e5-4e53-8270-fb7846b47c5d","year":2022},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:5be4e51ac93a9d7cb4b5af2fba0f98833e3a33b0730e506a20269740f75d14d8","observation_id":"4b3cf4ab-19c2-49fc-8904-afeea312dc83","resolution":{"observed_at":"2026-07-07T08:23:31.009410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.035755Z","title":"Illumination-guided RGBT object detection with inter- and intra-modality fusion,","venue":null,"work_id":"9b58cd3b-cfeb-4420-b396-db5a92c51405","year":2023},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:b9259b3454e8f274352c73c65fb44f9c1361fcdb97d46162d9b985e7b623eae5","observation_id":"475609f1-0cac-4bc5-a563-4c69aa1f24bc","resolution":{"observed_at":"2026-07-07T08:23:31.036919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.003031Z","title":"Weakly aligned feature fusion for multimodal object detection,","venue":null,"work_id":"f154c434-bd72-4730-a344-d1e23a4d6d9f","year":2025},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:3654644ce93bde0b918adb82e65c2b3fa5db1677585b09d36e6cf20e11b73b37","observation_id":"89d8c37a-3828-498a-a9e6-eb2d6d2f1d3d","resolution":{"observed_at":"2026-07-07T08:23:31.004135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.957571Z","title":"Fd2- net: Frequency-driven feature decomposition network for infrared-visible object detection,","venue":null,"work_id":"c8ad0260-2d2e-44f3-af0c-f12b988b6574","year":2025},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:c0256eedb73f6f6c12a3b7f84c14c22ce805a6928b9fe73a281df2b31259be00","observation_id":"a6fc8a1b-8dec-4402-8683-ae034357d400","resolution":{"observed_at":"2026-07-07T08:23:30.959017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.978445Z","title":"Attention is all you need,","venue":null,"work_id":"0bf18a60-8010-47d1-82a2-d04f1b462312","year":2017},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:1b364e067521610b22e21a4f60537c41037997b16afc6eca78f4fa6fa7e9d427","observation_id":"938c25f6-255e-46a1-9dde-c9f55d84419b","resolution":{"observed_at":"2026-07-07T08:23:30.979457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.990419Z","title":"An image is worth 16x16 words: Trans- MANUSCRIPT SUBMITTED TO IEEE TRANSACTIONS ON CIRCUITS AND SYSTEMS FOR VIDEO TECHNOLOGY 16 formers for image recognition at scale,","venue":null,"work_id":"41d66f7b-1da4-4629-92b6-4666df1774a1","year":2021},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:2b1ea3882eb61c16a07b7b4577c4a8179ac97595284211c228afa9ef1c780cc9","observation_id":"cc39d013-307e-4b0c-a32b-159e8cfe6c90","resolution":{"observed_at":"2026-07-07T08:23:30.991649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.042731Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":"b49ff572-1cf2-4bce-8d05-a7135a404676","year":2021},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:bf12a430d6561a0a3e742aff7b26c0af79b70d36ceae6fe9c0f9f4a0f100e194","observation_id":"9676f3d2-5db3-4660-8317-16daa87058d5","resolution":{"observed_at":"2026-07-07T08:23:31.043906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.939714Z","title":"Swin transformer V2: scaling up capacity and resolution,","venue":null,"work_id":"fa328cd8-7190-4612-8109-dec2697beb13","year":2022},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:28a6896daa10579e8d1aa90350c4e0b45d2c6f28d1b22269afd62ab384dd4e87","observation_id":"7f5b7983-5285-4d27-94c4-6cb0607bcbae","resolution":{"observed_at":"2026-07-07T08:23:30.941015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.950610Z","title":"YOLO-MS: multispectral object detection via feature interaction and self-attention guided fusion,","venue":null,"work_id":"4e997a7c-31bb-464c-bd04-116e9ea04e53","year":2023},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:ca281bb711ec03416ed610f2803620218ed781eb37b966665146500c25342d58","observation_id":"6751190b-0cf8-46c8-81dd-f3e52828a07a","resolution":{"observed_at":"2026-07-07T08:23:30.951745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.018595Z","title":"Multi-scale aggregation transformers for multispectral object detection,","venue":null,"work_id":"3c5d922d-39b0-4f0b-b4eb-5d3b2385052a","year":2023},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:528d07ef471a0ec8b7ca60c700c18b26478a9937e50ddb9d6f5922b0db709be5","observation_id":"f3220d51-65d9-4a7e-9945-542af3a8489b","resolution":{"observed_at":"2026-07-07T08:23:31.019791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.009952Z","title":"Differential feature awareness network within antagonistic learning for infrared-visible object detection,","venue":null,"work_id":"e78a8a5a-ab10-4e64-9a34-2cefa465d256","year":2024},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:3150b8bec3f0a50115f3cfb02b974c228148de32e18ccaddd2dd97cbfc200ae7","observation_id":"49a2d177-9b6c-4526-a147-3a45c3ffde73","resolution":{"observed_at":"2026-07-07T08:23:31.011110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.974287Z","title":"Mmi-det: Exploring multi-modal integration for visible and infrared object detection,","venue":null,"work_id":"03ce3a15-7cd7-4e3b-a3b4-93c0012e8453","year":2024},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:c62ecdc5d3628bcfe04d33c235c870c78a21d652f611dd8c1b5e99651f297b11","observation_id":"55a6a4bc-e5f2-4827-977b-5b06bb406e32","resolution":{"observed_at":"2026-07-07T08:23:30.975864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.943340Z","title":"Seadate: Remedy dual-attention transformer with semantic alignment via contrast learning for multimodal object detection,","venue":null,"work_id":"8900dc28-edb3-4ca6-80d5-3ac9a3b0c019","year":2025},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:391bf46fd564b0bd0eb2a225def4567e0bd9651bfb5e7c56b7b7d80bf78ebebc","observation_id":"b794f1ee-72b3-45ae-89e0-5e58c9545626","resolution":{"observed_at":"2026-07-07T08:23:30.944540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:37:03.519092Z","title":"Icafusion: Iterative cross-attention guided feature fusion for multispectral object detection,","venue":null,"work_id":"2308d447-e0b9-4f07-987c-f0d09df519c8","year":2024},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:0792b1d303dd378ae62eadf78965d8a86be98e870530f78df06e61bf59344ade","observation_id":"03ba3280-934f-4427-a89b-18f901cd0c6a","resolution":{"observed_at":"2026-07-07T08:23:30.946342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.029232Z","title":"Multidimensional fusion net- work for multispectral object detection,","venue":null,"work_id":"21921db2-4c99-41b4-9063-2dff4a966cc2","year":2025},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:a0790c9a6a5521c2a6e1c45072680bab432d086376147dfe6cd9fa0c03196c76","observation_id":"84791f34-aa3d-47f8-a173-4f1d242cf285","resolution":{"observed_at":"2026-07-07T08:23:31.030339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.024112Z","title":"Sparsevit: Revis- iting activation sparsity for efficient high-resolution vision transformer,","venue":null,"work_id":"885d7c1c-098a-4629-a93a-ef834e33f367","year":2023},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:7e0dd509ad3d4272d634ccfab4ca9616d295224686fb336ba738887ba65e5f43","observation_id":"2de2f9cd-c89f-48d2-b6d6-329ec5c4c9db","resolution":{"observed_at":"2026-07-07T08:23:31.025276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.946893Z","title":"Deformable DETR: deformable transformers for end-to-end object detection,","venue":null,"work_id":"aceb4c69-dcc3-4c1a-a1da-e47442606ec9","year":2021},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:a87cc215e549af43d65c8d790e21cae6912f84c9011318e0a7e71fda0dd7ba8f","observation_id":"3f5ce0f4-6486-4e24-b4d3-0fa4f42ab93d","resolution":{"observed_at":"2026-07-07T08:23:30.948169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.980008Z","title":"Dynamicvit: Efficient vision transformers with dynamic token sparsification,","venue":null,"work_id":"71a35391-6fed-4976-96f3-f429db4b027e","year":2021},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:0e71072996af6fb1cc6557097a71894469948d23191c6ec974ce0847700091a0","observation_id":"96638e2a-4698-4e11-8f2c-55fe9bbc5ee2","resolution":{"observed_at":"2026-07-07T08:23:30.981116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.964341Z","title":"Multi-modal feature pyramid transformer for rgb-infrared object detection,","venue":null,"work_id":"297b1fd3-f0fb-494e-bc87-8269be350d1f","year":2023},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:c244e856aef606eadfab27a45443c71036b61cff846e987b3028d77e73e1245e","observation_id":"c43ebf96-eb23-442c-8156-09bd2a34c388","resolution":{"observed_at":"2026-07-07T08:23:30.965432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.961226Z","title":"Run, don’t walk: Chasing higher FLOPS for faster neural networks,","venue":null,"work_id":"3952fe24-eb3e-4695-a3f6-062d72c537fa","year":2023},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:ad08c52dcc4b14bd6daf9989e01f83e66d8b3e77cacf89a07db12a7d7bf2ef01","observation_id":"87d21c37-7adc-4bdd-8f4b-8f94bf3088e6","resolution":{"observed_at":"2026-07-07T08:23:30.962322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04861","last_updated":"2017-04-17T03:57:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-04-17T03:57:34Z","title":"MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications","version":1},"cited_work":{"arxiv_id":"1704.04861","doi":"10.48550/arxiv.1704.04861","metadata_source":"pith","pith_arxiv_id":"1704.04861","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications","venue":"cs.CV","work_id":"3870239a-c950-4625-bf33-c4f902d14175","year":2017},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"cited_paper":"/paper/1704.04861","citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:98d8673cc12c899dd7ea20d72d9dec135982b307cb3b84c01b68793bcebc7d7c","observation_id":"e61b253b-90ef-4cf4-a5c0-9f1e677807eb","resolution":{"observed_at":"2026-07-01T00:45:11.958891Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.037457Z","title":"A tutorial on the cross-entropy method,","venue":null,"work_id":"ec874013-2d53-4101-8347-82f3c6e5b750","year":2005},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:378f378f56f1092722be91d2806021baa741f7b0795985ca44f2ad843bfef9de","observation_id":"7260781e-f6f6-4b49-9368-20810d26f4f7","resolution":{"observed_at":"2026-07-07T08:23:31.038575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.034030Z","title":"Generalized intersection over union: A metric and a loss for bounding box regression,","venue":null,"work_id":"6623a4c5-3e0c-41c8-9a63-c39b28f75d0e","year":2019},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:000bad38c54acc75760d04974f040985f6ac43504b7a5a7fc40c37d1183da664","observation_id":"37881810-a7da-4661-ae4f-960a3c987798","resolution":{"observed_at":"2026-07-07T08:23:31.035178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.941515Z","title":"Multispectral fusion for object detection with cyclic fuse-and-refine blocks,","venue":null,"work_id":"b18dd720-fa9b-4e55-aa1e-f8af71dbb740","year":2020},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:06626305ee491fc60e8d6667104a518b21407f16b73e5cda7198d202a2b09228","observation_id":"cca80f7a-6437-444b-8062-9368182656ae","resolution":{"observed_at":"2026-07-07T08:23:30.942655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.016673Z","title":"Target- aware dual adversarial learning and a multi-scenario multi-modality benchmark to fuse infrared and visible for object detection,","venue":null,"work_id":"0269d5f1-f4bb-4174-90b7-ed77ee1a223b","year":2022},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:c398ae31f33bcccbf54df788b479d9d01b655be07a61d2b9d71fa33a5a02f411","observation_id":"157d723e-fa98-46cc-816a-277e81612c88","resolution":{"observed_at":"2026-07-07T08:23:31.017892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.025806Z","title":"LLVIP: A visible-infrared paired dataset for low-light vision,","venue":null,"work_id":"590f819b-b249-4c0f-8538-4186706130fb","year":2021},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:6c22201fa2963f7d147aed203c0c77ada21918b1eb6ea79516e112538b49ba9c","observation_id":"cac184b8-29fd-49ba-8c6c-a49b2e752c38","resolution":{"observed_at":"2026-07-07T08:23:31.026955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.948848Z","title":"Ex- plicit attention-enhanced fusion for rgb-thermal perception tasks","venue":null,"work_id":"e76f7f2f-3f8b-4801-a3d5-4ff168369226","year":2023},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:ddd6fe053de8c5c02187b05b07feff691dee6d22886e1611d22468d2a8173ff3","observation_id":"8e1f63a5-34ab-423d-ab31-9caf868c8bb3","resolution":{"observed_at":"2026-07-07T08:23:30.950052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.983397Z","title":"Multimodal object detection via probabilistic ensembling,","venue":null,"work_id":"926bdea1-fe54-48e9-97c6-b4acd1d8cc06","year":2022},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:430bc6a65f5bce9c077820f25409e34a41bb326e92afe060515c52f2a001e1c4","observation_id":"3b1e6db6-2911-4476-abb4-c2880ddfd4da","resolution":{"observed_at":"2026-07-07T08:23:30.984587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.027556Z","title":"Fusion-mamba for cross-modality object detection,","venue":null,"work_id":"2a569eee-da63-4c0a-9e35-0505e8836945","year":2025},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:f56cd35ac85389cf72d7dc1a98070a37025bd8bc49dec91d4d7d86e4f7cb69fa","observation_id":"08850c5f-ec61-4523-8b56-41dae70c91b0","resolution":{"observed_at":"2026-07-07T08:23:31.028693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.032321Z","title":"Removal then selection: A coarse-to-fine fusion perspective for rgb-infrared object detection,","venue":null,"work_id":"6994ee41-eca3-4785-8862-bac4478976d9","year":2026},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:84b4a13343f5d9616022ba56aab8cbdc371c0242580b56336961a0edb2269d21","observation_id":"0ed83b22-5ca2-40ba-8b3b-eb6804cfeb33","resolution":{"observed_at":"2026-07-07T08:23:31.033499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.013396Z","title":"Dual-perspective alignment learning for multimodal remote sensing object detection,","venue":null,"work_id":"c8a2f0ca-df18-4b34-92d1-34c2062cc018","year":2025},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:9d3f49fe7ae940774dcf1438d46b86e4bbe5705b7eb942cb1380b860a1acec5a","observation_id":"4e500c0a-78a7-42a4-8b2d-f1f33e107bb0","resolution":{"observed_at":"2026-07-07T08:23:31.014506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.044445Z","title":"Dwsf-net: A dynamic wavelet-based spatial-frequency fusion network for multispectral object detection,","venue":null,"work_id":"4a13fcb3-b54b-470c-8903-7e3daaa58f39","year":2026},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:98bbecae01f82c8bc80c4838a359e3851762033c67330e3bae1ab875f0f06eff","observation_id":"9af069b2-be29-4262-9423-26e07e2ecc96","resolution":{"observed_at":"2026-07-07T08:23:31.045592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.986806Z","title":"Didfuse: Deep image decomposition for infrared and visible image fusion,","venue":null,"work_id":"567790cc-db10-468f-b640-82a6f5db93d0","year":2020},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:dbe0e0ecf51e8ebb8a96f1b5da4387a40c3bf561bda7a17352122c0132adc6a7","observation_id":"2f123f04-2dba-4e05-b96c-a00c627d756d","resolution":{"observed_at":"2026-07-07T08:23:30.987947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.992358Z","title":"Sdnet: A versatile squeeze-and-decomposition network for real-time image fusion,","venue":null,"work_id":"50977cc9-1de4-4cff-a71a-9d7e822d070e","year":2021},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:5d573e1dd570f950357bb3dfc4942a293c51631f35c2a21d1a685fa26681275c","observation_id":"a233d886-a7e9-4b1f-aecd-386ee9d5a58c","resolution":{"observed_at":"2026-07-07T08:23:30.993520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.953924Z","title":"Detfusion: A detection-driven infrared and visible image fusion network,","venue":null,"work_id":"607f8c2a-1633-4f9a-a3de-f21c5a7c4ad1","year":2022},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:6e1ecb780343b533f563c8db2fa774aa0aebba72dd3cf8bd00a33c59ddca1da4","observation_id":"29667a49-e88d-4ca6-8c41-11f64258f88c","resolution":{"observed_at":"2026-07-07T08:23:30.955068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.001230Z","title":"Superfusion: A ver- satile image registration and fusion network with semantic awareness,","venue":null,"work_id":"1010da57-90fd-440b-b137-3dd26e01fbab","year":2022},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:3064970c18b08dd11e1d5cf10225ba341680d003b85b4cd39df79e9693ba5471","observation_id":"b29bb5bf-fa44-464a-90cc-f5087de7b9b8","resolution":{"observed_at":"2026-07-07T08:23:31.002505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.967578Z","title":"Rfnet: Unsupervised network for mutually reinforcing multi-modal image registration and fusion,","venue":null,"work_id":"d67261ba-e904-404e-b179-0a87ba646bfd","year":2022},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:68d474f8a834baac825517b42e556791e85db2a583b6da382f112f96eea647ad","observation_id":"1572e2bb-0186-451d-b161-10943f0228e7","resolution":{"observed_at":"2026-07-07T08:23:30.968763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.969303Z","title":"Cddfuse: Correlation-driven dual-branch feature decomposition for multi-modality image fusion,","venue":null,"work_id":"16792c92-b037-4380-8331-983b57a80bc2","year":2023},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:6a00bf57b1a9748046ba83d80f12eca02268b2db966b4eeff5db9685e780acb9","observation_id":"0fec6b32-4fa1-49b4-8654-fc856e68bd82","resolution":{"observed_at":"2026-07-07T08:23:30.970450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.972611Z","title":"Learning a graph neural network with cross modality interaction for image fusion,","venue":null,"work_id":"87522cfc-ce68-4e05-94cd-7f3bafec0715","year":2023},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:234bc0d0438945a93da74aa1075efd87a60d6c139b949fc5dd4de6cb30143162","observation_id":"96ece8d5-2607-4a41-89f0-470cb726cc1c","resolution":{"observed_at":"2026-07-07T08:23:30.973750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.004676Z","title":"Multispectral state-space feature fusion: Bridging shared and cross-parametric inter- actions for object detection,","venue":null,"work_id":"d937cf99-1bfb-4e5a-9350-3a92792ad478","year":2026},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:5cb2597bfaf5cfa43ec9c7a12ef971bbcbb49189a8bd568d3db23f8a86358889","observation_id":"c0436fb8-81a6-45a0-b8f6-6212d7909c67","resolution":{"observed_at":"2026-07-07T08:23:31.005880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.970977Z","title":"Ccldet: A cross-modality and cross-domain low-light detector,","venue":null,"work_id":"a4e4815b-016a-4417-8007-407873c92eff","year":2025},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:feec52f5dccddbbbad4aeb69c5684b2f7a6c64afaa6f1e1b1609a2e9b84750e1","observation_id":"c5bdb3de-7304-45b9-866d-83748066dfbc","resolution":{"observed_at":"2026-07-07T08:23:30.972084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:31.039271Z","title":"Unirgb-ir: A unified framework for visible-infrared semantic tasks via adapter tuning,","venue":null,"work_id":"c127afb9-d8a0-4bd3-b0ed-db256fb0952d","year":2025},"citing_paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-01T00:40:57.018937Z"},"links":{"citing_paper":"/paper/2606.31015"},"observation_digest":"sha256:31f8b94fcfcc2b3e142ff40c324c244cb75923da5ad2bbac2f4b56b10850df7f","observation_id":"ca01fec1-3123-40d4-b3d9-8a785792be60","resolution":{"observed_at":"2026-07-07T08:23:31.040481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.31015","last_updated":"2026-06-30T01:05:24Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T09:02:52.845290Z","submitted_at":"2026-06-30T01:05:24Z","title":"Dual Sparse Aggregation Transformer for Multispectral Object Detection"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":2,"verified_fuzzy":61},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2606.31015."}