{"as_of":"2026-08-18T13:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ccdc4f40087e6be5ed28ef51b374d08f3061ab0d05718c47ec8bc148f427d88d","coverage":[{"denominator":87,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":87,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:04:00.870139Z","state":"measured"},{"denominator":87,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":87,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.03675/citation-record","integrity":"/paper/2506.03675/integrity","json":"/paper/2506.03675/citation-record.json","paper":"/paper/2506.03675"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.463645Z","title":"Fully convolu- tional networks for semantic segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.463645Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:afe720c1f83d964f9e9457e949fe02a0724e13552d696a906848962c58451a70","observation_id":"1b258a05-46e4-45ef-bdfb-6084bf9e584a","resolution":{"observed_at":"2026-08-07T11:04:00.463645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.468441Z","title":"Deeplab: Semantic image segmentation with deep convolutional nets, atrous convolution, and fully connected crfs,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.468441Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:3acbf278dccb97fe3e0648e928a3b327d03362604d3565713d497e66e5d680b1","observation_id":"cbc2be4c-6205-4a5e-8d69-a3b2d74079b6","resolution":{"observed_at":"2026-08-07T11:04:00.468441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.473059Z","title":"Encoder-decoder with atrous separable con- volution for semantic image segmentation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.473059Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:7aa6ea948fb98da41bbd1f9467825e56bd94ff6a58f5ae2bbbcea16b9be10bd3","observation_id":"0f6eac92-46b4-4706-9320-7ab406e8ce3a","resolution":{"observed_at":"2026-08-07T11:04:00.473059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.477789Z","title":"Rethinking semantic segmentation from a sequence-to-sequence perspective with transformers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.477789Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:1f02410bd527c207a60b5facc3d5f74686b6936e9ea9223866ae54c671dde3bd","observation_id":"fd0a2738-d60c-462a-a08c-9a860a46db87","resolution":{"observed_at":"2026-08-07T11:04:00.477789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.482334Z","title":"Contour knowledge-aware perception learning for seman- tic segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.482334Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:a7bcaeb0a562212efbfb4c984b76fbb923200935592041b380f2534130a5f64e","observation_id":"7fc3c472-5236-4337-b9c0-00710d45137a","resolution":{"observed_at":"2026-08-07T11:04:00.482334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.486394Z","title":"Omnisam: Omnidirectional seg- ment anything model for uda in panoramic semantic segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.486394Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:1a122dd4bf53878cfd3a059716fc55b337845860162a8e4c7f58256b19025b40","observation_id":"fc321bbf-6e3f-438f-9d3b-22e9b9b7364a","resolution":{"observed_at":"2026-08-07T11:04:00.486394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.491149Z","title":"Muses: The multi-sensor semantic perception dataset for driving under uncertainty,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.491149Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:80e0ea281a5e5a9c5ea84d91a2dc3ba0d240e8a529c2cbce13a2d1394b24d01a","observation_id":"3edec125-49c8-4d1f-9286-f6f1edd3799e","resolution":{"observed_at":"2026-08-07T11:04:00.491149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.495448Z","title":"Delivering arbitrary- modal semantic segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.495448Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:e731732362c9e7d4736496fd9fad6d66141a1c8f5b188e12c3e1079bac054a22","observation_id":"c5927e21-e05f-4ee9-bbf4-56d8874d9ed9","resolution":{"observed_at":"2026-08-07T11:04:00.495448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.106528Z","title":"Indoor segmentation and support inference from rgbd images,","venue":null,"work_id":"43d52148-4cfa-41d1-8407-7400d068b3e1","year":2012},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.499805Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:0374013c714ec3bab31d28f6074f5c85830ee34549d2b6b49450e11b4f376a9d","observation_id":"7d14dabd-e728-493f-a73b-a4a152d4f0b0","resolution":{"observed_at":"2026-08-07T11:04:02.111109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.092747Z","title":"Centering the value of every modality: Towards efficient and resilient modality-agnostic semantic segmentation,","venue":null,"work_id":"5da7634e-63e6-4078-8f90-dcd68e4880ce","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.504618Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:28d91c19c6549fcc48cde7b31410007b4ed32a9faaec66bafcb8b8d0d3b9f83b","observation_id":"8d864917-01d2-40cc-960d-8de33b8fe35b","resolution":{"observed_at":"2026-08-07T11:04:02.097218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17141","last_updated":"2025-05-15T18:54:21Z","snapshot_observed_at":"2026-08-12T12:25:58.124112Z","submitted_at":"2024-11-26T06:15:27Z","title":"Learning Robust Anymodal Segmentor with Unimodal and Cross-modal Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17141","snapshot_observed_at":"2026-08-07T11:04:00.509320Z","title":"Learning robust anymodal segmentor with unimodal and cross-modal distillation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.509320Z"},"links":{"cited_paper":"/paper/2411.17141","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:b7e94f4552e7a9d1983dfe9cd3ddd6fcb3389e667face89c852168f9f951a7ce","observation_id":"7684729b-52e1-4c8c-8a7a-8331fa9631ae","resolution":{"observed_at":"2026-08-07T11:04:00.509320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.078171Z","title":"Cafuser: Condition-aware multimodal fusion for robust semantic perception of driving scenes,","venue":null,"work_id":"6ee4c3ca-a3a7-40c2-9173-20c964f7c593","year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.513880Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:606155bcf2a10d0ea96d91d6efaa51bb7697fe3fe8c6ee2e29935a2c836b58d3","observation_id":"dada0cfc-525c-4500-9f1f-b5742af6cbf3","resolution":{"observed_at":"2026-08-07T11:04:02.082719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.064104Z","title":"Learning modality- agnostic representation for semantic segmentation from any modalities,","venue":null,"work_id":"abb452eb-9d27-48ce-a95b-60bef452a756","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.518184Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:bd0aa3ed5e58a8053dea8ce6454ebdc178eae686bde377200d1843e3e01b9801","observation_id":"a66de4a8-c509-4bc3-9181-0cb903a6115d","resolution":{"observed_at":"2026-08-07T11:04:02.068649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.048596Z","title":"Cmx: Cross-modal fusion for rgb-x semantic segmenta- tion with transformers,","venue":null,"work_id":"b199a027-ae26-44c1-9dd6-695fbe1ed605","year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.522131Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:80714e27f534570ff344597cbc54a74f791b284b1678a128fe2f39ab02354053","observation_id":"4c02518b-9a2d-4196-853e-2d865590ebbb","resolution":{"observed_at":"2026-08-07T11:04:02.054223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02581","last_updated":"2025-07-22T13:20:58Z","snapshot_observed_at":"2026-08-18T08:58:31.049671Z","submitted_at":"2025-03-04T13:04:46Z","title":"Unveiling the Potential of Segment Anything Model 2 for RGB-Thermal Semantic Segmentation with Language Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02581","snapshot_observed_at":"2026-08-07T11:04:00.526326Z","title":"Unveiling the potential of segment anything model 2 for rgb-thermal semantic segmentation with language guidance,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.526326Z"},"links":{"cited_paper":"/paper/2503.02581","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:2ec63e4ab1ec218e1223a2a0b31e70e112b7809d9f6db2ad31718b5eda18e3de","observation_id":"85c2180f-2b79-46a1-8897-ba83e26bbc90","resolution":{"observed_at":"2026-08-07T11:04:00.526326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18445","last_updated":"2025-04-10T08:56:52Z","snapshot_observed_at":"2026-08-18T08:57:39.236049Z","submitted_at":"2025-03-24T08:46:52Z","title":"Benchmarking Multi-modal Semantic Segmentation under Sensor Failures: Missing and Noisy Modality Robustness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18445","snapshot_observed_at":"2026-08-07T11:04:00.530644Z","title":"Benchmarking multi-modal semantic segmentation under sensor failures: Missing and noisy modality robustness,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.530644Z"},"links":{"cited_paper":"/paper/2503.18445","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:680a50800ae5512b1079aa0987e1ff5c89a52736e841bb2db2ae51b5db09d117","observation_id":"60019358-77f7-4544-af4c-11f73801300b","resolution":{"observed_at":"2026-08-07T11:04:00.530644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.033321Z","title":"X-prompt: Multi-modal visual prompt for video object segmentation,","venue":null,"work_id":"5bfd8680-0684-4df9-b62f-ac8ffe6c7cd7","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.535096Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:036bdd0bd3f9d303972b0eb6f5d527fe354a161d2b002adbbe90a61b70f9b087","observation_id":"a4b7217e-9a89-473a-8f95-479c9f0055df","resolution":{"observed_at":"2026-08-07T11:04:02.038582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.019259Z","title":"Ro- bust multimodal learning with missing modalities via parameter-efficient adaptation,","venue":null,"work_id":"0b2992ee-7ac6-4b9c-a06a-5419f035431a","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.539016Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:becf0e0846823e55ee9e76b22a939fd45f0d9c82e0d3dd4e7c8a2e68d050afd3","observation_id":"87e16734-282d-4612-a637-01de39377f06","resolution":{"observed_at":"2026-08-07T11:04:02.024031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09668","last_updated":"2024-02-07T11:07:29Z","snapshot_observed_at":"2026-08-16T19:16:34.764885Z","submitted_at":"2023-09-18T11:09:11Z","title":"DFormer: Rethinking RGBD Representation Learning for Semantic Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09668","snapshot_observed_at":"2026-08-07T11:04:00.543430Z","title":"Dformer: Rethinking rgbd representation learning for semantic segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.543430Z"},"links":{"cited_paper":"/paper/2309.09668","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:0cd39c95b520b5c2d420b1c818a8d1bd5bcebaf62de9f68e2e68384fb06587be","observation_id":"d7ed4ac6-79ef-4b78-9c47-0cb2e8190850","resolution":{"observed_at":"2026-08-07T11:04:00.543430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.004164Z","title":"Cpal: Cross- prompting adapter with loras for rgb+ x semantic seg- mentation,","venue":null,"work_id":"e9c5e715-4ff2-4124-b26e-9a0d1d51f396","year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.548760Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:48627b5bc2adcc6e0c5c125ad4a0960d68c7fb7b86777a04fe03f402627b8da9","observation_id":"d483dc7a-46b7-4694-96bf-d2f64c94c675","resolution":{"observed_at":"2026-08-07T11:04:02.008789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.989056Z","title":"Context-aware interaction network for rgb-t semantic segmentation,","venue":null,"work_id":"b4cb772c-2331-4852-a198-23907d5bf0d5","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.552744Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:d161f934eb3e7845fe361b8b790bf46c7c08db77fae16ece9de411715034a702","observation_id":"4d989659-0d80-4d5f-b850-251511ee77f8","resolution":{"observed_at":"2026-08-07T11:04:01.993801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.973271Z","title":"Embracing events and frames with hierarchical feature refinement network for object detection,","venue":null,"work_id":"05e9ca76-4047-4f7d-bbaa-7d0cf018fb3a","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.556877Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:b1341a1e70c5107c1810baf00a3fc5bafabba5d647ecfdd4cc6e0e0a329e8ceb","observation_id":"e7dd0730-d7f9-4bbe-9a49-b8a13798a4d9","resolution":{"observed_at":"2026-08-07T11:04:01.978318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.957932Z","title":"Mawkdn: A multimodal fusion wavelet knowledge distillation approach based on cross-view attention for action recognition,","venue":null,"work_id":"b6494ce9-8153-4e87-888b-c32fd69e89b7","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.560815Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:ecc9aa8f00b5fa50b4f3af2f9866c81b9415439f781127f8bd1b8910c55489a2","observation_id":"739022c0-43f9-4078-8430-5ad5962d06a9","resolution":{"observed_at":"2026-08-07T11:04:01.962794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.941986Z","title":"Cpal: Cross- prompting adapter with loras for rgb+ x semantic seg- mentation,","venue":null,"work_id":"4e6064b5-1195-4f47-b5e8-26e137432b0b","year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.564769Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:d66c80c9f8d61a520441c214e1c0065832e57579ed9b1f12b3d9973205f7bea7","observation_id":"6e923aa9-94b9-4009-8c9c-01e670eb183e","resolution":{"observed_at":"2026-08-07T11:04:01.947259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.925534Z","title":"S3f2net: Spatial- spectral-structural feature fusion network for hyperspectral image and lidar data classification,","venue":null,"work_id":"35ab5f5b-2981-4797-90bd-26b411bff7c1","year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.568839Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:b4037c4dc77a30706e234e4f36e85c93872175803238053d440c28334101cf91","observation_id":"a7957b06-7a5a-4f04-9884-19d81db84db3","resolution":{"observed_at":"2026-08-07T11:04:01.930862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.910854Z","title":"T 2 ea: Target-aware taylor expansion approx- imation network for infrared and visible image fusion,","venue":null,"work_id":"04f6eba2-1003-48c7-90e5-41c914318d5b","year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.572887Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:8ef8931f15bbb842a480d7770636416bbf46fcf39550d681659ef606f897c3dc","observation_id":"c5013d83-4476-4994-b741-7593ca0b105f","resolution":{"observed_at":"2026-08-07T11:04:01.915599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.895472Z","title":"Nuc-net: Non- uniform cylindrical partition network for efficient lidar semantic segmentation,","venue":null,"work_id":"ca34a0f2-d0c9-4f3d-ba56-43f4d391902b","year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.577374Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:28cb97f4cb0615db80c736198274e474508b8fda77060b1d0905d0c626feb16a","observation_id":"e1ac892b-907c-46ea-b348-451fd1f7947c","resolution":{"observed_at":"2026-08-07T11:04:01.900337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06635","last_updated":"2025-05-10T12:58:15Z","snapshot_observed_at":"2026-08-17T18:52:10.932653Z","submitted_at":"2025-05-10T12:58:15Z","title":"Reducing Unimodal Bias in Multi-Modal Semantic Segmentation with Multi-Scale Functional Entropy Regularization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06635","snapshot_observed_at":"2026-08-07T11:04:00.581807Z","title":"Reducing unimodal bias in multi-modal semantic segmentation with multi-scale functional entropy regularization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.581807Z"},"links":{"cited_paper":"/paper/2505.06635","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:3b34fe9001aa97ee333ccd6eb2394dcbdf76f4133948804c5a94010983ea5e2c","observation_id":"c7243d09-eeae-4c5f-a155-1e5b031e0ed9","resolution":{"observed_at":"2026-08-07T11:04:00.581807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.879712Z","title":"Primkd: Primary modality guided multimodal fusion for rgb-d semantic segmentation,","venue":null,"work_id":"168c1d93-eea8-4a04-b699-4ae77c95c880","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.586563Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:902bd66c0793ce29462a42e88cd366171fe4d815d0435c6151471a96dd76e276","observation_id":"3e395c87-633c-4aa0-ac8d-6a716ccb44f1","resolution":{"observed_at":"2026-08-07T11:04:01.884761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.865021Z","title":"Imagenet large scale visual recognition challenge,","venue":null,"work_id":"34eecae9-350e-4fbf-91c6-5c5fdcc6b87f","year":2015},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.590946Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:3340ab27211a48ef297e66fec7fa639d8eb087c7efa1d0dce9168139dfd1c2fb","observation_id":"e30a52cb-98e5-4b6e-aaf7-a686af2fe480","resolution":{"observed_at":"2026-08-07T11:04:01.869683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.594913Z","title":"Masked-attention mask transformer for universal image segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.594913Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:d890b4b488b749b6785ce3d326870f33105d3283fb7ff3fd235e3d0c58da62ed","observation_id":"9c3577d8-fe22-4ab8-a290-51d59436bcbc","resolution":{"observed_at":"2026-08-07T11:04:00.594913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.839575Z","title":"Per-pixel classi- fication is not all you need for semantic segmentation,","venue":null,"work_id":"1b1ddd03-ae9d-47e2-b71a-2eb4e44a6de1","year":2021},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.598937Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:03a1c41d1d683c8cbae6b14e36f7b1c3c19e606c4837a1c8f254ce76af896f30","observation_id":"dbdeb659-6f03-4004-b13c-2a8497727dc8","resolution":{"observed_at":"2026-08-07T11:04:01.844583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.824973Z","title":"Group detr: Fast detr training with group-wise one-to-many assignment,","venue":null,"work_id":"1432184c-9ad1-423f-92a0-e20b64a4ab30","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.602750Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:0779d696da251312fbe6c74053a131ea07643d964928352a3f79aecb58f1b697","observation_id":"5f309f33-de7f-4c28-aadb-8add8eb703a1","resolution":{"observed_at":"2026-08-07T11:04:01.829820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.809760Z","title":"Detrs with collaborative hybrid assignments training,","venue":null,"work_id":"38daf34a-d407-48ed-ba76-3f64c5c86ed1","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.606579Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:477970cf8b91779cd650c1ffec4613437a45ec8f71eea5b1eb8f31d9b88958e1","observation_id":"f1345d5d-ac5c-4535-a10e-5520b4578dcf","resolution":{"observed_at":"2026-08-07T11:04:01.815228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.794541Z","title":"Detrs with hybrid matching,","venue":null,"work_id":"6b542c53-c0a1-4794-9da2-e92c776189b6","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.610669Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:dde6b5163824c4e60bbcd32c02c161766228a1ee6d0b79a87391326a67ccae19","observation_id":"c432808b-9ec8-49bd-9934-4284ad5ea05b","resolution":{"observed_at":"2026-08-07T11:04:01.799859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.778551Z","title":"Ms-detr: Efficient detr training with mixed supervision,","venue":null,"work_id":"8f88445b-0b33-433b-85a2-a4d97e1bf619","year":2020},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.614876Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:a82b01d11c8c28b6aea2a9686195aa7ae815d081731a6447c334bc794e48cceb","observation_id":"eded07c9-8f60-4282-9921-d9a2db812599","resolution":{"observed_at":"2026-08-07T11:04:01.783744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.762241Z","title":"Detection transformer with stable matching,","venue":null,"work_id":"ca39af8f-3113-492f-983a-0c13be9ac42a","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.618666Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:943c2342609910aec5c81dd5f86c2587c0dfffd6b144048bac5192df41039419","observation_id":"2ff03b25-9c8b-4fcd-ab0b-b257366ea2a9","resolution":{"observed_at":"2026-08-07T11:04:01.766791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.747331Z","title":"Rank-detr for high quality object detection,","venue":null,"work_id":"461e3c54-6738-4393-a221-bc9d94d42ace","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.622722Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:885066954de9a8cfd75ebe5bc86c9decff70c363bf87e742a6f7b785c6310069","observation_id":"bde81fa0-16db-4a6a-91a7-42171bd1d085","resolution":{"observed_at":"2026-08-07T11:04:01.752114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03605","last_updated":"2022-07-11T10:30:29Z","snapshot_observed_at":"2026-08-18T07:50:02.322273Z","submitted_at":"2022-03-07T18:55:26Z","title":"DINO: DETR with Improved DeNoising Anchor Boxes for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03605","snapshot_observed_at":"2026-08-07T11:04:00.627257Z","title":"Dino: Detr with improved denoising anchor boxes for end-to-end object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.627257Z"},"links":{"cited_paper":"/paper/2203.03605","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:7f65222d747442296ef6761998b968f109cc86210b4ac785fccde53b791dc79d","observation_id":"09f8dc25-66df-4cc2-8d7e-3d3f6c38b237","resolution":{"observed_at":"2026-08-07T11:04:00.627257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.731052Z","title":"Emo2-detr: Efficient-matching oriented object detection with transformers,","venue":null,"work_id":"9f620584-f47e-46b3-9c02-6bec8ed1b5f5","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.631710Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:3b094d0a54837c2bde9f8ba9e50007625e894f923145a99fff297ab444a3d985","observation_id":"40ae5cb2-1281-4b87-93dd-a3e3e29953a5","resolution":{"observed_at":"2026-08-07T11:04:01.736649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.714603Z","title":"Hybrid proposal refiner: Revisiting detr series from the faster r-cnn perspective,","venue":null,"work_id":"d5bfb62e-8437-4979-9d4e-d6234a8a6b28","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.635575Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:b0ddd4b3b00c48c164b5b125b85b8b05c0ff04892878f411aaf48ed2a6500d80","observation_id":"fce1bd6b-e1b2-4a83-9514-afedbcc918c5","resolution":{"observed_at":"2026-08-07T11:04:01.719811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.699155Z","title":"Salience detr: Enhancing detection transformer with hierarchical salience filtering refinement,","venue":null,"work_id":"04b02df0-37ba-446a-97f6-ae8fb1dcb87e","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.639910Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:24b5bc068d1cb776f28c4c556291a4b34fa4e58b23c8498c7b4dc8d2284f0af2","observation_id":"0a0893db-8e2e-4eda-8b11-d2b86db6af07","resolution":{"observed_at":"2026-08-07T11:04:01.704051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.644467Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.644467Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:909eeed2e7fb65a4e19f1a8d7c4d7ce8811aecd45cba88bb9fdb1a39dde14b15","observation_id":"04b723a1-e390-410c-bdf4-ddbf0f874ce0","resolution":{"observed_at":"2026-08-07T11:04:00.644467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.673999Z","title":"Going deeper with convolutions,","venue":null,"work_id":"bbc2d06b-3ba0-464a-9a26-4234818837b6","year":2015},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.648338Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:0a64d8bd70c52d5ac31e2066fcd64d5932ef89438c1a869065bd88f9a3084d1a","observation_id":"68e7a3b6-f594-48a5-a09f-d611ac3218c0","resolution":{"observed_at":"2026-08-07T11:04:01.678869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.652621Z","title":"A convnet for the 2020s,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.652621Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:0a88c2d0313cf432cf2afc2009a42b022eab1ef9eae89bd88197100f209c090b","observation_id":"5b093bbc-cdf5-4d9b-a91e-b49e4f6181c0","resolution":{"observed_at":"2026-08-07T11:04:00.652621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04220","last_updated":"2024-12-05T14:54:31Z","snapshot_observed_at":"2026-08-17T23:29:24.004954Z","submitted_at":"2024-12-05T14:54:31Z","title":"Customize Segment Anything Model for Multi-Modal Semantic Segmentation with Mixture of LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04220","snapshot_observed_at":"2026-08-07T11:04:00.657432Z","title":"Cus- tomize segment anything model for multi-modal semantic segmentation with mixture of lora experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.657432Z"},"links":{"cited_paper":"/paper/2412.04220","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:e8f68ddceb562ae1716500780ffb2972d1840505ace0096a7637d1f903bc090c","observation_id":"c21fc46d-3cad-44e9-a2f6-8e307c9da61d","resolution":{"observed_at":"2026-08-07T11:04:00.657432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.648929Z","title":"Adversarial co-training for semantic segmen- tation over medical images,","venue":null,"work_id":"e24f43e3-49ea-4a11-894c-a4337e10fcc8","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.662672Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:0b2f01c8bce2046207056af9f217fc9f1b4ae747c1477606504707c23d917bf9","observation_id":"8135c43d-c0ba-47db-9bde-be3a68684a20","resolution":{"observed_at":"2026-08-07T11:04:01.653572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.667774Z","title":"Look at the neighbor: Distortion-aware unsupervised domain adaptation for panoramic semantic segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.667774Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:e3a0c115626ee6e41579e54b721eef8aa339ca323c543bdb3817a2e9b8759275","observation_id":"dee1a2ac-6f76-49e2-aa27-4ae7c6eba2c3","resolution":{"observed_at":"2026-08-07T11:04:00.667774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.624093Z","title":"Deformable convolutional networks,","venue":null,"work_id":"fb84e697-9ffc-4e23-a98f-a1a550d5cfc3","year":2017},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.672191Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:38b6aee1c33c00a4348fd5d4f0d08e877b39982ba193555d7d63d598cc8a4148","observation_id":"25bbc081-3c56-4608-9c27-35f3124fd4e0","resolution":{"observed_at":"2026-08-07T11:04:01.628584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.608672Z","title":"Segformer: Simple and efficient design for semantic segmentation with transformers,","venue":null,"work_id":"ee9a1f22-4f59-4cdc-a011-c1f5ea5e600f","year":2021},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.677130Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:1a42c19eabf47a0755c398599faf963ecd9058709b67ccd7ebb4e20f5c826a44","observation_id":"2815ca5a-15a9-4103-8559-e60d21c5023a","resolution":{"observed_at":"2026-08-07T11:04:01.613184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.595318Z","title":"Segnext: Rethinking convolutional attention design for semantic segmentation,","venue":null,"work_id":"4db43aa2-cc72-4e58-8c9d-96a34ace8999","year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.683044Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:dce4432228b4e8544515dacd160ed5264c7f9c1c0362592f6b4a6fe5cad46429","observation_id":"90830fe5-444e-492d-8c35-35960de78dde","resolution":{"observed_at":"2026-08-07T11:04:01.599650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.581221Z","title":"Frozen is better than learning: A new design of prototype- based classifier for semantic segmentation,","venue":null,"work_id":"918725f2-1106-4f69-a237-aa5557839d03","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.687789Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:3112b83e41496c59b55fcc6d91d72fbf7dff0d5f079dfd186b5c6330f00ccf08","observation_id":"7ceb9021-8c9c-4ef7-8032-b9f80244d04c","resolution":{"observed_at":"2026-08-07T11:04:01.585874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.567624Z","title":"Uncertainty-aware deep co-training for semi- supervised medical image segmentation,","venue":null,"work_id":"1c6d5300-29ab-497d-862e-b0155986d90f","year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.693373Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:7b54c0fe71372477bdddea94ae27218d8a1ec022d1a9e2f93da1cf7e5cbfcbd2","observation_id":"1fae5683-53f4-42f2-a1ec-282b96baaf68","resolution":{"observed_at":"2026-08-07T11:04:01.571937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.553734Z","title":"Both style and distortion matter: Dual-path unsupervised domain adaptation for panoramic semantic segmentation,","venue":null,"work_id":"c2bc2c8f-9781-4752-ac23-87700de14257","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.698671Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:935ca1c8178f33165f27f717826f064e08cb0b9495b305eb509809e0fd693519","observation_id":"1285a183-63a3-4a73-bda0-dbce9c4426d7","resolution":{"observed_at":"2026-08-07T11:04:01.558494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.539683Z","title":"A good student is cooperative and reliable: Cnn-transformer collaborative learning for semantic segmentation,","venue":null,"work_id":"556218f1-7523-4896-a7d1-49ff3b59837b","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.705084Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:9c4e097f1c0cbcdc1487e3a474921faeb95774ec1dad2dc9571dc1b4c6ba9702","observation_id":"467d4ae0-adf9-447b-9f87-0575eae88b9c","resolution":{"observed_at":"2026-08-07T11:04:01.544352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.525436Z","title":"Semantics distortion and style matter: Towards source- free uda for panoramic segmentation,","venue":null,"work_id":"13941ab7-2f7a-43be-90d9-1aba796e52d7","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.710670Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:7f4672b02c47c344b521d7fe57ddcad4eccbb9b229ef2a99f93d751dc534eb7c","observation_id":"b1bff59f-0b95-4ad6-819f-18b403aac779","resolution":{"observed_at":"2026-08-07T11:04:01.530177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.511903Z","title":"Attention is all you need,","venue":null,"work_id":"20062400-6d62-4588-9ffe-54aab036b575","year":2017},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.715830Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:0ba2da7e76c218956b32433f07e2845d5b97d6e18fa676831aa5089bdcf7fab9","observation_id":"3811f309-0207-400c-811b-084416b6bea8","resolution":{"observed_at":"2026-08-07T11:04:01.516392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T11:04:00.721118Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.721118Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:1bb68a598ec255291d5493e8ffd46a3a9737428df3cddcdf13d646148849358a","observation_id":"f01095fd-8be7-4ea8-8285-473cbe345e81","resolution":{"observed_at":"2026-08-07T11:04:00.721118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03135","last_updated":"2024-07-24T13:50:56Z","snapshot_observed_at":"2026-08-16T15:10:28.775050Z","submitted_at":"2023-08-06T15:05:42Z","title":"EventBind: Learning a Unified Representation to Bind Them All for Event-based Open-world Understanding","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03135","snapshot_observed_at":"2026-08-07T11:04:00.727420Z","title":"E-clip: Towards label-efficient event-based open-world understanding by clip,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.727420Z"},"links":{"cited_paper":"/paper/2308.03135","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:a3714d9c58e95f3aae79b907f6cf4d268f82fe5aa0c6de1a6895caa89e75f17d","observation_id":"fbefb9b9-6294-401e-9abb-3c3080be1ec6","resolution":{"observed_at":"2026-08-07T11:04:00.727420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16108","last_updated":"2024-05-25T07:45:41Z","snapshot_observed_at":"2026-08-18T08:58:32.629714Z","submitted_at":"2024-05-25T07:45:41Z","title":"OmniBind: Teach to Build Unequal-Scale Modality Interaction for Omni-Bind of All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16108","snapshot_observed_at":"2026-08-07T11:04:00.732923Z","title":"Omnibind: Teach to build unequal-scale modality interaction for omni-bind of all,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.732923Z"},"links":{"cited_paper":"/paper/2405.16108","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:77a68d0ea39e1c4101e71f54e11a2d35b200f6eb23c5657d0f559e656a693247","observation_id":"c0434cf8-ba3b-402e-aabc-5f41d0e2de49","resolution":{"observed_at":"2026-08-07T11:04:00.732923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.497105Z","title":"Exact: Language-guided conceptual reasoning and uncertainty estimation for event-based action recognition and more,","venue":null,"work_id":"e7229984-88b4-4b40-9542-748a1ac4d8c7","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.738471Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:083b98e157b76cbd67fe268c373bd1da8bdd50f33af8c62715e1349c55ebb655","observation_id":"60965e60-4676-4b21-b9e6-183321bf6050","resolution":{"observed_at":"2026-08-07T11:04:01.501835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.482468Z","title":"Missing modal- ity robustness in semi-supervised multi-modal semantic segmentation,","venue":null,"work_id":"b202c855-ea28-41bc-a4c1-fb1e65d05cec","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.744026Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:336852f32066ae2f9ef142ec4bdf50441ec42fc539546eb5edea517e2b7c407c","observation_id":"b46f05cb-96bc-4f91-ab6f-0c17a1b693e0","resolution":{"observed_at":"2026-08-07T11:04:01.487199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.467621Z","title":"Towards good practices for missing modality robust action recognition,","venue":null,"work_id":"2ac1fe1c-eaca-4931-9205-7b23546c1f26","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.750010Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:17e82bb1743f850dcde9214c28790cad39a338cd66bb7bbe32f4d24c177dc3a5","observation_id":"33d0b394-ede4-45ca-9375-f9f366a24afe","resolution":{"observed_at":"2026-08-07T11:04:01.472508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.453201Z","title":"Unified multi-modal image synthesis for missing modality imputation,","venue":null,"work_id":"a2c81501-dd38-417b-9151-84590dff8b5a","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.754926Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:5755b19caae15d6e79b60a27b32c317896a993a20d6b8fd763d3ad8d4c9dda3b","observation_id":"f32ade72-c97a-44d4-b057-9d2ed05f7db6","resolution":{"observed_at":"2026-08-07T11:04:01.457939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.438562Z","title":"M3ae: multimodal representation learning for brain tumor segmentation with missing modalities,","venue":null,"work_id":"12694cc4-ca32-44c6-a8ff-2015e577dd8f","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.759901Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:ca1bc6969d9e00e9928b478da805799e92986c2e14e8527c3a32d473b93942fb","observation_id":"abf56ed5-9e0e-43c7-8f6a-cd83eba56d94","resolution":{"observed_at":"2026-08-07T11:04:01.443336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.422487Z","title":"Semi-mamba: Mamba-driven semi-supervised multimodal remote sensing feature classification,","venue":null,"work_id":"5ceb2641-f924-4345-9157-4da0759852b1","year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.765276Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:8bb053deb73fd6e100d438948295d589342fc43e620cbf709a2328a46f761fe0","observation_id":"1b957305-4cdd-4da7-ae4c-c3255a7c6409","resolution":{"observed_at":"2026-08-07T11:04:01.427608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08890","last_updated":"2024-04-11T15:34:46Z","snapshot_observed_at":"2026-08-17T09:05:47.162911Z","submitted_at":"2023-02-17T14:19:28Z","title":"Deep Learning for Event-based Vision: A Comprehensive Survey and Benchmarks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.08890","snapshot_observed_at":"2026-08-07T11:04:00.771080Z","title":"Deep learning for event-based vision: A comprehensive survey and benchmarks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.771080Z"},"links":{"cited_paper":"/paper/2302.08890","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:37cdebedc06a953b166126ea80dcd6d6a248809b6f59ac41bfd685c564f017c0","observation_id":"c9d38745-974f-4587-b0fc-16b5690e280c","resolution":{"observed_at":"2026-08-07T11:04:00.771080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.406714Z","title":"Chasing day and night: Towards robust and efficient all-day object detection guided by an event camera,","venue":null,"work_id":"75468f43-9b73-4064-97ae-34a22eefbd40","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.777068Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:8b1ab73aafe487d222229614c12676ac51fa1aa0476f050bf0b0628d14e11f05","observation_id":"a947058e-ad07-4925-b7e2-3cae33de7f12","resolution":{"observed_at":"2026-08-07T11:04:01.411602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.391393Z","title":"Unibind: Llm- augmented unified and balanced representation space to bind them all,","venue":null,"work_id":"e0efc279-88b2-4b80-a6a9-27ed27c33b61","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.782728Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:7dc4681440f61291d5b435c3f3e64753825e6cdc48e3dffdd49124ec82801b49","observation_id":"4f717564-93c7-47ed-aa3c-8f81e612f825","resolution":{"observed_at":"2026-08-07T11:04:01.396350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.376526Z","title":"Eventdance: Unsupervised source-free cross-modal adaptation for event-based object recognition,","venue":null,"work_id":"68fbeb4f-617c-4d0f-b4fd-fa4178bb0087","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.788052Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:d3b6ba2a5d81d37fc204aa6f0e988530f41b03f237d6d6d2365f4b353f7c3f96","observation_id":"5a389bdd-68b1-4914-b3dc-3a288fb8a2ec","resolution":{"observed_at":"2026-08-07T11:04:01.381116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.362414Z","title":"Eventbind: Learning a unified representation to bind them all for event-based open-world understanding,","venue":null,"work_id":"64b3ba9f-ef2b-469d-bb3b-f696670e4c92","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.793431Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:44cd114cdee619dd7401ca00f7c5188f88d7378355f73178a1a1f4cfaf26f731","observation_id":"3ac21538-25ad-4b79-9435-6ef779c7d4cb","resolution":{"observed_at":"2026-08-07T11:04:01.366901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06700","last_updated":"2025-03-20T18:36:20Z","snapshot_observed_at":"2026-08-18T08:58:35.718160Z","submitted_at":"2025-03-09T17:33:15Z","title":"MemorySAM: Memorize Modalities and Semantics with Segment Anything Model 2 for Multi-modal Semantic Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06700","snapshot_observed_at":"2026-08-07T11:04:00.798023Z","title":"Memorysam: Memorize modal- ities and semantics with segment anything model 2 for multi-modal semantic segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.798023Z"},"links":{"cited_paper":"/paper/2503.06700","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:b2ef837f25ec6973db1ec421caa46c3cbe2cc9c3720ed71796f2ca3a07196eb0","observation_id":"3722a80e-04f1-49be-b4ac-0f7b9bfeeb85","resolution":{"observed_at":"2026-08-07T11:04:00.798023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16876","last_updated":"2024-12-22T06:12:03Z","snapshot_observed_at":"2026-08-15T05:47:29.055177Z","submitted_at":"2024-12-22T06:12:03Z","title":"MAGIC++: Efficient and Resilient Modality-Agnostic Semantic Segmentation via Hierarchical Modality Selection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16876","snapshot_observed_at":"2026-08-07T11:04:00.803912Z","title":"Magic++: Efficient and resilient modality-agnostic se- mantic segmentation via hierarchical modality selection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.803912Z"},"links":{"cited_paper":"/paper/2412.16876","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:80403870a726f37020ca3f08511c3d6e948cbfa9f43d02f30bd3736fff74e4b8","observation_id":"79a60b95-a4a7-4e0a-938b-6a32b5a57d18","resolution":{"observed_at":"2026-08-07T11:04:00.803912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.346965Z","title":"Fcos: Fully convolutional one-stage object detection,","venue":null,"work_id":"8298fbb6-6dd6-4aae-bc14-b603086c011f","year":2019},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.809604Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:def719b8360917b5469a2c19ecae3bba00ce4465b809482278299ba1252f407b","observation_id":"3e677c59-3523-4910-a01d-737c2c5e6edc","resolution":{"observed_at":"2026-08-07T11:04:01.351857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.814311Z","title":"Focal loss for dense object detection,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.814311Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:27dd4810bd003707271185541b920ff3c054ff452aa63c42988c648de2f02115","observation_id":"c4c44799-24d6-4376-9f9a-e3d76b2f2fb9","resolution":{"observed_at":"2026-08-07T11:04:00.814311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.321978Z","title":"End-to-end object detection with transformers,","venue":null,"work_id":"c66f09cd-4f60-4425-9da9-1a1a0db88ff4","year":2020},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.819403Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:26a462bb794de8fb27926139a6bef2568f97d9435e7a0a2af17b384915943e45","observation_id":"74076452-ed14-4cf9-8c99-0b525e30dec1","resolution":{"observed_at":"2026-08-07T11:04:01.326502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.306333Z","title":"Mask dino: Towards a unified transformer- based framework for object detection and segmentation,","venue":null,"work_id":"765f34b8-908c-4525-a9cc-c02b99ae5568","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.824393Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:0fe3e7cd0debe338297f6b57edd0549a8d316eedfd146d2103d3610c9aca9a73","observation_id":"2229a1c8-baea-4986-8170-68a654d8715b","resolution":{"observed_at":"2026-08-07T11:04:01.310990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.291231Z","title":"Primitive generation and semantic-related alignment for universal zero-shot segmentation,","venue":null,"work_id":"b471462f-5bf8-4d61-a064-b068ba459ff5","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.829429Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:4436b14033bde12bba7b20f06583017cb0c9b387ea59ee5daf809f723d04bd7c","observation_id":"e7fee3c7-777e-4e40-b0fd-69b11354e52a","resolution":{"observed_at":"2026-08-07T11:04:01.296122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13697","last_updated":"2024-02-21T10:57:21Z","snapshot_observed_at":"2026-08-18T10:56:05.262098Z","submitted_at":"2024-02-21T10:57:21Z","title":"Generalizable Semantic Vision Query Generation for Zero-shot Panoptic and Semantic Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13697","snapshot_observed_at":"2026-08-07T11:04:00.833790Z","title":"Gen- eralizable semantic vision query generation for zero- shot panoptic and semantic segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.833790Z"},"links":{"cited_paper":"/paper/2402.13697","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:ab077c79535e9107e49fe53b93a16c6cc825d2a70fa4c74ff722c231fe542ecc","observation_id":"7810af1e-3748-4971-8b65-b40194d410ef","resolution":{"observed_at":"2026-08-07T11:04:00.833790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.276102Z","title":"Acnet: Attention based network to exploit complementary features for rgbd semantic segmentation,","venue":null,"work_id":"95082c0b-8322-4469-8282-88217753ff9f","year":2019},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.838599Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:f2e55f4039c9717236dcf5ba6f79a85397e935486a304ac4c6a95518fce28e4f","observation_id":"a4c40b69-dc76-4db3-a7cb-c7066ea7c017","resolution":{"observed_at":"2026-08-07T11:04:01.281044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.261473Z","title":"Shapeconv: Shape-aware convolutional layer for indoor rgb-d semantic segmentation,","venue":null,"work_id":"cdd9daa8-b35a-40fa-8dca-786c9cf3b493","year":2021},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.842951Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:43e0f8546579b2b20fc55390f1ea2ad3596d713735bdb7f4eb4481aff6387c57","observation_id":"f6e336a3-0e03-4250-81b7-1d30fbe18aa2","resolution":{"observed_at":"2026-08-07T11:04:01.266073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.847251Z","title":"Aggregated residual transformations for deep neural networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.847251Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:75e0a2da803021595ac23145cb59642c685bb1cceaf2f9e5c64e3138923e57e5","observation_id":"d4177e31-54f2-4720-9402-5490a648afd4","resolution":{"observed_at":"2026-08-07T11:04:00.847251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.236108Z","title":"Efficient rgb-d semantic segmentation for indoor scene analysis,","venue":null,"work_id":"abb2ca70-04e6-475e-982d-c4938ec36d99","year":2021},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.851918Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:8cd6d9a285ade3ba680d16b38eb855ed96b4bf3c24ed07fd746eda24da388bcc","observation_id":"8c559ef2-90ee-4002-95f3-f983288c102b","resolution":{"observed_at":"2026-08-07T11:04:01.241496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.220577Z","title":"Multimodal token fusion for vision transform- ers,","venue":null,"work_id":"434c872b-931e-44cb-aa30-2fcbf5f654b1","year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.856773Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:2933d73ad8b270772b8f41e386ffcff0ff68c1a53c92d12d354e305a5b596bb2","observation_id":"97a397eb-72f7-4464-ac1d-5528e8023c9c","resolution":{"observed_at":"2026-08-07T11:04:01.225280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.860997Z","title":"Omnivore: A single model for many visual modalities,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.860997Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:0289d1a241a7e130212368ce365c29f9853b8208183ad84e4de46a7228297ff8","observation_id":"56ff219a-4c1b-4c22-88cc-16e5e2204c51","resolution":{"observed_at":"2026-08-07T11:04:00.860997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.865416Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.865416Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:bae8455764ce3448d58f39e09b66c518d5ac55e927c8523f7e4c8285c59759b6","observation_id":"9be0eaf8-2e99-4e47-8a0f-16d7ef59df28","resolution":{"observed_at":"2026-08-07T11:04:00.865416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.185248Z","title":"Prompting multi-modal image segmentation with semantic grouping,","venue":null,"work_id":"fe124c29-78e5-4d57-bcad-b3ccf043b2af","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.870139Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:e830dcc4be0cb835bf7efceece4856d8bb95c16ff09d86dede13ae50dc61bcd1","observation_id":"b8c3a830-b3c7-4975-98bf-27300e50b614","resolution":{"observed_at":"2026-08-07T11:04:01.191808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation"},"reference_resolution":{"displayed":87,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":57},"total_outbound_references":87},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 87 of 87 outbound references and 0 inbound Pith citation observations for arXiv:2506.03675."}