{"as_of":"2026-08-04T20:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:08437a29c2f9cea45a3360369b4e10fca353983b454a431976ad77abb4c424d0","coverage":[{"denominator":117,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T17:31:28.553260Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.08906/citation-record","integrity":"/paper/2606.08906/integrity","json":"/paper/2606.08906/citation-record.json","paper":"/paper/2606.08906"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Towards complex backgrounds: A unified difference-aware decoder for binary segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:fffe3d503c77d11ea7e7ac76636dc9291e07d813be0511171b09cfe1fe9728ca","observation_id":"5911e80b-a809-48f8-9a65-f03a2ca49bb2","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Towards diverse binary segmentation via a simple yet general gated network,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:5ea8741553a824adbe72153e27f53da9a94bb13abf790dcac3fc1a7e6fdc6b97","observation_id":"a83b5597-971f-470f-9ad2-d31d309d06a2","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Deep fourier- embedded network for rgb and thermal salient object detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:fa949e60232573a1b3d9697b4c0d09d6d7727ac60e8492946d60a37e110b3bdc","observation_id":"9067fd0f-647f-449f-ac4b-d8e7ac4251b5","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Towards unifying saliency transformer for video saliency prediction and detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:1ad72b788b275a86ecbc85f6fdb9c623f38643cb1b85036183a90c8a64226f35","observation_id":"f05ad147-d32b-4397-979a-02037d86e1ec","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Camouflaged object detection with adaptive partition and background retrieval,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:9d64a25d94acc1b161d9fcbcd031cc9b2ebd2bd475f55089518e304f40291c43","observation_id":"f48e99e5-18e9-48b1-960b-2ec42a0becd5","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Tanet: Tri-aspects network for camouflaged object detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:076adb434ad59db31d35045b7229086a65100916c0cf88ebfd5dad5044909897","observation_id":"4ebc9852-c271-42c1-b7dc-ee00053b7a4f","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Enhanced boundary learning for glass-like object segmen- tation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:3ac287073634e0f5a8f41700f3bad59f7ac60312a92546a68906501cefc80ef6","observation_id":"016b6290-fc82-47d7-a259-1694864b3d40","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Defocus blur detection via depth distillation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:a6f0c6bba5140f549a1ae1007a04ac836dbb8e6e98854fa046a5f0de93e33682","observation_id":"9d864f79-b141-42b7-ada9-faa0024b3776","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Noise-consistent siamese-diffusion for medical image synthesis and segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:73d17e67aa0dd3663e40823002145ed5016f13091923f05adcce68e89abc386d","observation_id":"546207a5-6987-4cee-b258-ecc80819b9fa","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Flownet 2.0: Evolution of optical flow estimation with deep networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:3f5b050e6c5f97d10b95f3e36d002da8a0e82e358b19388aae119c83ce243663","observation_id":"898448eb-06f7-4071-adde-aa1dc6d09a3b","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Explicit visual prompting for low-level structure segmentations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:dd2d7c2b83fe75fe7ddd7ef8b4091204fcc57bebb8877124fb8d9526e689d4f7","observation_id":"f289b3e8-3053-4b6f-ab83-ead2d13fb8aa","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01002","last_updated":"2024-05-28T04:09:30Z","snapshot_observed_at":"2026-08-03T08:44:53.926014Z","submitted_at":"2024-05-02T04:58:29Z","title":"Spider: A Unified Framework for Context-dependent Concept Segmentation","version":2},"cited_work":{"arxiv_id":"2405.01002","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.01002","snapshot_observed_at":"2026-07-03T00:07:27.848403Z","title":"Spi- der: A unified framework for context-dependent concept segmentation,","venue":null,"work_id":"5c7be070-2c81-480d-8368-718f960d646a","year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"cited_paper":"/paper/2405.01002","citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:ef63896a531379a2ba66c8c6e4787e536ca7b103fb5e975afe5ca27f2e1afbb8","observation_id":"70d7e27c-fb95-4082-9885-849ec7470ecb","resolution":{"observed_at":"2026-07-03T00:07:27.849953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Focus: Towards universal foreground segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:322b512d2163bfdc66f394b4567c7d39651c16b02348fc0cfc5f28e66971fa90","observation_id":"9a584d98-31c0-4969-bbcc-dfddf8e35de6","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2408.08870","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T00:07:27.853995Z","title":"Sam2-unet: Segment anything 2 makes strong encoder for natural and medical image segmentation","venue":null,"work_id":"bc4a5643-3e3b-49d7-bb44-541b54d7c6f8","year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:717de032dee51ae23df9c929bb4633cca3b0efc223bd82db39a83d5e1b048208","observation_id":"7de63ba6-59d0-4942-8bc0-fc8d09dd8143","resolution":{"observed_at":"2026-07-03T00:07:27.855775Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2604.00684","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T00:07:27.852875Z","title":"Tp-seg: Task- prototype framework for unified medical lesion segmentation,","venue":null,"work_id":"1a84c473-9442-4544-b566-806e998446fb","year":2026},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:d29419747ee8ff029f9f84489ccaf9b74badc2cde7eb7ed0e2a8f228cec34a60","observation_id":"53effa6f-152a-4e6d-8da3-199c2cff3367","resolution":{"observed_at":"2026-07-03T00:07:27.854369Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Samba: A unified mamba-based framework for general salient object detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:1880a23ba8056a771a69c6467b16df67930685026560fbc0d666e99268ad0277","observation_id":"fd9fdddb-81dd-4592-b549-3d53eb57216c","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Hvpnet: A unified bio- inspired network for general salient and camouflaged object detection,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:c89c6b6eaee2d17c67337134efeeb00fbe969b0645c3b81bebad2df9d4be4cd0","observation_id":"6e674ed5-4851-40cc-afcb-a1c46a113f45","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Vscode: General visual salient and camouflaged object detection with 2d prompt learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:0e9a86f15ceb1b1edcd1a13e0e52bbfdb238d72090d564944712f3b901fc913a","observation_id":"21f767ec-a71d-40c1-9719-e3ffc38d1010","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Detect any mirrors: Boosting learning reliability on large- scale unlabeled data with an iterative data engine,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:361aeb42287627b6474ceec84e45e481ca595fca876139dd9ff16795adede1e6","observation_id":"96141dd7-c846-4578-b690-2aacfab569d2","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Revisiting weak- to-strong consistency in semi-supervised semantic segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:9e48b40b49ec0d2de636ab996517ee2d7f2d270a7c523d1a7dccb8a6f4e9b35f","observation_id":"eca95a14-af97-42c1-b15c-e39ed48b9142","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Endow sam with keen eyes: Temporal-spatial prompt learning for video camouflaged object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:3d96fc7cbb0cd3d4264713fb423946a752697ffdf3f2e666a326cf0a736dd2d6","observation_id":"649f168a-9d08-45d1-b114-ec0c29651d37","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Frequency-spatial entanglement learning for camouflaged object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:ee67c29f608d6a552f89046c7cd790042f687cc617fa5edaef380e063833e112","observation_id":"93b71f22-7ba1-4799-a450-909e9cbcc179","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Depth-aware concealed crop detection in dense agricultural scenes,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:8cc382bfcd9728dc0662f2dee57688e3cdbfe94e082c4377f02ada4c48de05e5","observation_id":"3a42ef57-1059-44c7-94a3-149dd5676f2f","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06042","last_updated":"2025-03-28T03:12:15Z","snapshot_observed_at":"2026-08-02T11:17:33.769678Z","submitted_at":"2025-03-08T03:39:03Z","title":"Improving SAM for Camouflaged Object Detection via Dual Stream Adapters","version":2},"cited_work":{"arxiv_id":"2503.06042","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.06042","snapshot_observed_at":"2026-07-03T00:07:27.839237Z","title":"Improving sam for camouflaged object detection via dual stream adapters","venue":null,"work_id":"7b9ad1cd-8ba5-47b9-984b-84f08612a6aa","year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"cited_paper":"/paper/2503.06042","citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:4f57297490ee165a296a149b8f1350c8726ff80aa2f8f1ad9be244e1e3b12531","observation_id":"f3aa1334-714a-4465-a988-fc6cc6f421c7","resolution":{"observed_at":"2026-07-03T00:07:27.840657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Differential feature awareness network within antagonistic learning for infrared-visible object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:0ec80e8d4409b59aefe728024bbed4fe9abb2e7ff472bc7173d6a2ee2a7c3de5","observation_id":"e5290d0e-7f07-4186-97bb-7d2908d5b1e8","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Rcnet: Dual-network resonance collaboration via mutual learning for rgb-d road defect detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:cc6edf0f85b30a20a282b5a7f2acbbbf8c9659dac82ccd4a921a15ec7eb766d1","observation_id":"839a8caa-04f4-477e-aa55-69b9c3cf3eaa","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Fmtrack: Frequency-aware interaction and multi-expert fusion for rgb- t tracking,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:b032169faae99237d7c3653c6be7776b659015834f2e78c1a4345e315855e03c","observation_id":"6242f501-1d8e-444b-8856-e9d794682d8a","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Semantic-orthogonal multi-modal attention network for rgb-d salient object detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:e9f53cdfb8c626ba8573baa66a9f244ce6e03967d483d7f3d1401f27e1116a26","observation_id":"dd7662ce-884c-4d67-af5c-88f7d40e0bbb","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15700","last_updated":"2024-05-09T06:20:32Z","snapshot_observed_at":"2026-07-06T18:04:50.648027Z","submitted_at":"2024-04-24T07:38:14Z","title":"MAS-SAM: Segment Any Marine Animal with Aggregated Features","version":2},"cited_work":{"arxiv_id":"2404.15700","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.15700","snapshot_observed_at":"2026-07-03T00:07:27.823321Z","title":"Mas-sam: Segment any marine animal with aggregated features,","venue":null,"work_id":"20577d04-31ea-4082-ac28-092e7c11f1f9","year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"cited_paper":"/paper/2404.15700","citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:64e95619c7fa7e2944998b45de7dda4c566ab912ae862c332b60582066a1ffc2","observation_id":"0ff92751-b207-40ea-a8b9-0dc7631f742b","resolution":{"observed_at":"2026-07-03T00:07:27.824816Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Adaptive illumination mapping for shadow detection in raw images,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:dc2bbb9b1664893752e09f58e79d6fcfd701cac30f250766fa61063da72c8169","observation_id":"f72c587f-2a78-466b-b0bf-71910a5113d0","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Msu-mamba: multi-scale defocus blur detection using cross- scale fusion and state-space models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:925726c8b501d5cf8e778a731a4e7f90b2ca807dea2192a799d22dbe49ff4cda","observation_id":"d9066f0e-c794-46ce-9074-38f28baba891","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06099","last_updated":"2023-07-12T11:45:22Z","snapshot_observed_at":"2026-07-31T19:58:47.747831Z","submitted_at":"2023-07-12T11:45:22Z","title":"RFENet: Towards Reciprocal Feature Evolution for Glass Segmentation","version":1},"cited_work":{"arxiv_id":"2307.06099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06099","snapshot_observed_at":"2026-07-03T00:07:27.835866Z","title":"Rfenet: Towards reciprocal feature evolution for glass segmentation,","venue":null,"work_id":"a54093e6-b694-4f8d-9c32-a13f70fa92ab","year":2023},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"cited_paper":"/paper/2307.06099","citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:d742a5ed8b5464fa2e1cd863f47349391395bb793d211c679b92d35348143b32","observation_id":"5a09793a-088e-4b93-a89a-c827af2a6aab","resolution":{"observed_at":"2026-07-03T00:07:27.837416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Decor- net: a covid-19 lung infection segmentation network improved by emphasizing low-level features and decorrelating features,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:f6895aa4cfb1be33afaf25ba42ff9d326bd6b0670a711d2b01862f4108c0782b","observation_id":"725b2329-8491-4017-bd3f-b9018a0e448a","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"A dual-branch network for ultrasound image segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:5ff6a961b6024e1ef7fdda2420ac606f568ee7697856e00b25c7a7dd9bb35b4e","observation_id":"d36de974-dc5a-416e-a24f-d1e8e3fe994c","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Flowsdf: Flow matching for medical image segmentation using dis- tance transforms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:2ffef2b6ac5a1463a89f7d493a7887112b0585d7733b0962113cb3c5bd0479ce","observation_id":"7c6a1068-10a3-46f1-a4ac-2c08ab9a1155","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Controllable-lpmoe: Adapting to challenging object segmentation via dynamic local priors from mixture- of-experts,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:c7079c9ff8c101324eb88b6ae186dcf4a63815875a3eea5d66ca800862740069","observation_id":"1552c86e-84fe-485b-8152-c84277bed8c7","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"De-lightsam: Modality- decoupled lightweight sam for generalizable medical segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:f2674c9880f767c73f8952d79fe1672dc0abec23d75caaab87f72f35c8f5334d","observation_id":"87de2c8e-26bc-4e9d-9b66-36075dca4415","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:cf164cbe1b433ae9f0770b739a97629bd73a366b24276fee3d9ad63b5317b545","observation_id":"e4b04a27-d2f4-4b81-8982-ad3c667958fe","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Vst++: Efficient and stronger visual saliency transformer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:afa112fce14ddb1240e54848502910a0b5d040cb7cfccec789b2c93f7ec118a6","observation_id":"7f74f533-0dc2-4b95-a354-8abf945186b3","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Effective video mirror detection with inconsistent motion cues,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:af72f74c982a4ae7e98a18193ead4c1858a1053ee958585564fde5d10deecb50","observation_id":"339c9d21-f58e-43f3-9c32-751d76268750","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Modality-induced transfer-fusion network for rgb-d and rgb-t salient object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:0b00835ee980325c692fd99b2659694a99307c7b6d0e8e495f672a0bcecdcb79","observation_id":"8fc00ed5-254d-4797-ac74-7d34236d5039","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Unified-modal salient object detection via adaptive prompt learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:4f2a7c305a18cb733d729010976c796600e6987511331d050b01796d156f1802","observation_id":"0660ea29-a2e5-44d1-9cc0-fa6df5382a48","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Improving sam for camouflaged object detection via dual stream adapters,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:4ef11e0d9065014bd5368dd18f1312ba9f00208949bb8893922865e0da0c319b","observation_id":"cde4dc0f-e45a-4a30-8b9a-8541a88850f4","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Segment anything,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:b6386ece63850675e1009f7627b76fb768c646efe4e4d6aa7760b6744eaad899","observation_id":"8e56cffb-2ba6-4107-ac36-078023ceac64","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":"2408.00714","doi":"10.1038/s41598-025-97590-3","metadata_source":"pith","pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SAM 2: Segment Anything in Images and Videos","venue":"cs.CV","work_id":"acc13f66-d814-44f9-9688-375688bf2d4a","year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:b93653be66321d154e7f0ee8e2ede8cf334221381543fa67621005f54d46b2bd","observation_id":"2aaca43d-e2d4-42d5-a888-183bdb1faa68","resolution":{"observed_at":"2026-07-03T00:07:27.842394Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-24T04:24:23.885301+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T04:24:23.885301+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03605","last_updated":"2022-07-11T10:30:29Z","snapshot_observed_at":"2026-08-03T01:52:36.481243Z","submitted_at":"2022-03-07T18:55:26Z","title":"DINO: DETR with Improved DeNoising Anchor Boxes for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":"2203.03605","doi":"10.48550/arxiv.2203.03605","metadata_source":"pith","pith_arxiv_id":"2203.03605","snapshot_observed_at":"2026-07-10T13:57:06.952129Z","title":"DINO: DETR with Improved DeNoising Anchor Boxes for End-to-End Object Detection","venue":"cs.CV","work_id":"4e842f69-fa99-4dde-b8a7-b5a558d4c80b","year":2022},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"cited_paper":"/paper/2203.03605","citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:75e4d23ca259367fb832561ee44211b271df7557dbe061ebbc80482ce6d0a2f0","observation_id":"bf29fe30-1f75-4339-b702-44ca2e0531c8","resolution":{"observed_at":"2026-07-03T00:07:27.828054Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":"2304.07193","doi":"10.48550/arxiv.2304.07193","metadata_source":"pith","pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-07-11T00:07:42.299741Z","title":"DINOv2: Learning Robust Visual Features without Supervision","venue":"cs.CV","work_id":"26b304e5-b54a-4f26-be7e-83299eca52e4","year":2023},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:ff9acbb8e4afbd542316f4ef42fe5469dd46c5830f41cfbab938b7ed6b50620d","observation_id":"26fa7a7b-c537-4d90-a4b4-bd20f00b69e4","resolution":{"observed_at":"2026-07-03T00:07:27.847295Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04579","last_updated":"2024-08-10T11:20:52Z","snapshot_observed_at":"2026-07-06T18:58:30.942582Z","submitted_at":"2024-08-08T16:40:15Z","title":"SAM2-Adapter: Evaluating & Adapting Segment Anything 2 in Downstream Tasks: Camouflage, Shadow, Medical Image Segmentation, and More","version":2},"cited_work":{"arxiv_id":"2408.04579","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.04579","snapshot_observed_at":"2026-07-04T10:19:47.765999Z","title":"SAM2-Adapter: Evaluating & adapting Seg- ment Anything 2 in downstream tasks: Camouflage, shadow, medical image segmentation, and more","venue":null,"work_id":"cabca584-efb1-4a9c-98f1-e278f30017df","year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"cited_paper":"/paper/2408.04579","citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:bbaff30a8f9e8b37b0895f9ff7b49405c14d4e3c600640a5a09a2c8aa13c8d25","observation_id":"c63863eb-f71c-488a-9efc-9a6dd1c89370","resolution":{"observed_at":"2026-07-03T00:07:27.858657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Edge- aware feature aggregation network for polyp segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:08c0b6d2b2ac64852bbf33192d0b7b8d136fc4d792c6e7a9d3e16024992992ec","observation_id":"469048f8-84f5-4d72-9c6c-ba17cb7501f7","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Generalized intersection over union: A metric and a loss for bounding box regression,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:05957179c4db763bc91275c57912c2da2b1ef520b69d9e72a4b274649fcefe9f","observation_id":"50a6bc92-9afe-41e9-9ecb-0f03fe39f8cb","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Generalized cross entropy loss for training deep neural networks with noisy labels,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:3ba81d3f17eba4143a50b29cc2da55c0e7a4d0d23fcdca16846ec9e9c79d60cb","observation_id":"196b8e8b-d0f6-4d1a-a884-6d8510db704e","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Learning to detect salient objects with image-level supervision,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:923637cf0626367c984839afe97f6624b46bfa73cb8bea7f6deeb9303df5e32a","observation_id":"e4a086cc-2114-489a-84e0-fbf7129a5832","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Saliency detection via graph-based manifold ranking,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:3268856814bb5189dd0580de82e1e869f7651b1280c391e3c2fb5a13c38c9c46","observation_id":"83778daa-ea3c-45f8-8595-dbebfdeab9ef","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Visual saliency based on multiscale deep features,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:621cc41a2b09cc4aeb6ba0a9907acf878a885d58e7244bccf49ea3961125abfa","observation_id":"f289e609-4f65-4ec8-81e3-4dbc5efa5afc","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Leveraging stereopsis for saliency analysis,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:10c46b64d980fd0fbdc34d87a077f28ce39d29f0e2beb3836441361913eba93e","observation_id":"51bd28e1-46f9-43eb-a0d5-3466761d9bc4","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Rgbd salient object detection: A benchmark and algorithms,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:b57a7f5d06ede6d1986ffa4d9215b9d57162c5951b2bb7bcded265ea35c2e98f","observation_id":"897aa928-84c3-4594-a8f0-fd937aa5b4d8","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Depth-induced multi-scale recurrent attention network for saliency detection,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:c3cda8caf1530b558b6b7213fbfd9b1dd04e87959234baa42e4c5f997c7f10a0","observation_id":"8d5780af-713e-4010-9f68-0658b2377405","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Vscode-v2: Dynamic prompt learning for general visual salient and camouflaged object detection with two-stage optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:84f92272162cd321924e063e1afd3d53dabe4ee5776eff9086a339034d337737","observation_id":"fd1ace8b-a068-4db9-b364-83ccd5bc192d","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Rgb-t saliency detection benchmark: Dataset, baselines, analysis and a novel approach,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:519fc145c64398a2df1b205caf86e40634ddb7c700074919ed8623a1fee3dcea","observation_id":"7f70b249-14bf-4e89-a520-d2c763e0d349","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Rgb-t image saliency detection via collaborative graph learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:397b68ec660a2725908a7c1e0d9c741faf1cb65b10d7544b3f72a8eb0efa52ae","observation_id":"a6b898f4-1f5f-452c-91f0-581b941bc596","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Rgbt salient object detection: A large-scale dataset and benchmark,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:29426fffb370ec12592f5829ea2cee5584e337ad00312e42192341deb05096af","observation_id":"7d1ca0d5-98a3-46b2-9cea-e7791990e1dd","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Segmentation of moving objects by long term video analysis,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:661a3014df249a10980e76cf13fdf2cdd9332d1b42be40e5b83d789f93f3d9aa","observation_id":"3f08b005-fedf-4c7c-a0fc-ab27b2464e87","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"A benchmark dataset and evaluation method- ology for video object segmentation,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:37ad6f5f018a6a293ec439ff1c6ff44ebd28779899de7e8098534ffa98909a60","observation_id":"3673ab5a-bf57-4d65-9e0f-00c87b70f14f","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Shifting more attention to video salient object detection,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:f8e3f25907c52af265570167fcfdb82ba4724efdb13ce02ba7b4a5f66f8c7fa8","observation_id":"99f92693-8dbb-4026-845c-63a6b8782647","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Learning complemen- tary spatial–temporal transformer for video salient object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:9f97d351f491505a3c2199af610bfacaa4e9dd4054559b0f46915584b71976aa","observation_id":"602e3c82-6eab-4d35-a704-bb7d923233cc","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Dimsod: A diffusion-based framework for multi-modal salient ob- ject detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:8772931e75cb58dd2896721e296909f6a4d18499571008bdc905b59907fecad6","observation_id":"e57dd0dc-c85c-4d21-a345-4172ee88de38","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Alignment-free rgb-t salient object detection: A large-scale dataset and progressive corre- lation network,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:11071ce61114b9f6d4bcdf62eebc6b95c1f35937047dabbf9391f916ba27f45e","observation_id":"181aac62-80dc-4408-843c-146bb737d684","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Anabranch network for camouflaged object segmentation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:fbcdcb2114c4eb8c8bd2db95ec61925cc4de95a02025c80978086c2cc16cc0ab","observation_id":"743ce40b-98b8-4af6-b440-9b627be972c2","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Camouflaged object detection,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:352fa73c51a17e8b73b95cccd0a7d6ff60d9771d3c35e0863a4469c5f7a42352","observation_id":"4b5e1850-a6d7-4060-ad21-077e6d4ff7e6","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Simultaneously localize, segment and rank the camouflaged objects,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:b34362adac187ec1cde2aa0cecbd81f23cc65ecab3c113bb0249b844bf8f1ac3","observation_id":"be619599-994f-4f08-85bd-d1c0aea04dd8","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Implicit motion handling for video camouflaged object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:a433332e0e86fe1ba34713aa9647794bedf1247239f146592ffaba124a2eb46d","observation_id":"30c85062-138c-451c-a4ce-0df93e9c9353","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"It’s moving! a probabilistic model for causal motion segmentation in moving camera videos,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:fb0c46b43b76677cc3f1498b08db7a2727cce167c3d773b34c4934e88b2d59dd","observation_id":"332585a6-f74b-4741-91ef-85fd64130717","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Source-free depth for object pop-out,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:490215592edb9a95ddbf6e242fa6b37cd88613782d2ceb972bcd5984ae95deaa","observation_id":"6beda608-6784-4554-ad97-269b782be238","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Implicit-explicit motion learning for video camouflaged object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:1f6ab4a0c6c681b82beeeb6990ef71de5ef025986d42118e6cf6bebea32e1b6c","observation_id":"ac8bda67-db35-48c2-8275-70b3abfc11a5","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Depth alignment interaction network for camouflaged object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:43e0a62ff3bed29372dac257f63ef8a160c5131d5cfe6cdcb16beff191e7af73","observation_id":"df002bb6-d778-400a-9ee8-f3f2326c8db9","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Sam-pm: Enhancing video camouflaged object detection using spatio-temporal attention,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:05aa8b03108b32d43eff7a957eb6f069a33f23922d7b39d2069a562dab9d2b08","observation_id":"58f6296c-8ce1-4ed4-ad36-a108badc273f","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Explicit motion handling and interactive prompting for video camouflaged object detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:2709502464328c2fdfbee68e08f979c6808169f1389745416d34f06272939b8c","observation_id":"aa9ecd24-1f7d-4123-a805-d605a3bc6c38","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Where is my mirror?","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:13419fca2a31dd1b11f1c93d0f20f115937b196df421ebe74a04fed8d51f93b6","observation_id":"4dec4bba-b05c-4080-8fd1-8a0b7989e4c3","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Progressive mirror detection,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:1b45e6a80be1fa6337827f56816421e9c20fbf7d5e68f6b90e49d70e7541eb9a","observation_id":"ad931cf4-2c60-4cac-bd97-aebba460b6c3","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Depth-aware mirror segmentation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:b2a9f4bf34f6528601dc07c94e677dd33357d5a3c65b936bc6542c811ca9dbd7","observation_id":"4c7348fa-4db8-4f9f-8add-2a5826312f47","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Learning to detect mirrors from videos via dual correspondences,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:8d6d68a9f437a5226ab7a7e21868745033ac395a38dc8a7c7c89589b4b9a57ef","observation_id":"40207867-9171-4a05-930a-4b3d9166ad61","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Marine animal segmentation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:61b11ce72b72ea0c25428e62bfab2a98b457ca11caa7955e7538f2b341e43e9e","observation_id":"ad0b73d2-80b1-430c-9704-cabc94e11996","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Masnet: A robust deep marine animal segmentation network,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:3ab525417055c44a5e23e51e994f78501306e2676a5a1c501e02c3de87f0a395","observation_id":"1ba08b60-c31f-4333-a0a8-cc047287bb9c","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Large- scale training of shadow detectors with noisily-annotated shadow examples,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:c9d0ce2a2be4b7c60602c90c2eaf63a05c9dde7e4c861f0ac3e3f02b98a5ff9c","observation_id":"9697ac5b-fcc9-457e-9ff2-9fca57fe1746","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Segmenting transparent objects in the wild,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:53b4772c13becf6c84481a305c47b5cd91aae8f6b4c37466a98def6780b651f3","observation_id":"913214a5-75fa-4a87-b1ba-35ff08eedf29","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Discriminative blur detection features,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:edee66744b9d377c135d3ef46c39c22b17aaa42fe5b47907c6ffcc400578d640","observation_id":"179c8e83-6bad-4996-9422-3db8b589f910","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Fantastic animals and where to find them: Segment any marine animal with dual sam,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:2bb36e3bd1725f8315edafcf9c6d42d69f0c580e237abc2d15d2d0c15d3f7cbc","observation_id":"141d8284-b1e2-42d5-afd9-0d8303fed8e6","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Bg-uisnet: A novel boundary- guided network for robust and precise underwater image segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:ad1a8747eb841ce36a15e298c270dedd30f4ba84f80c0130ef6022597cb909e1","observation_id":"6f6b4e46-00f3-48ec-9579-f36581cf5ee4","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Automated polyp detection in colonoscopy videos using shape and context information,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:3ed2672477fcc245ff1ea5c34f1576c88155a4248dc5812fbfa598686f451422","observation_id":"e424d36f-505b-4b3b-9170-3323cc982282","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"A benchmark for endoluminal scene segmentation of colonoscopy images,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:de24a28cb94e22b66f31a9c3c0859188cd33004a2c6ae281537e93c45a1fb79d","observation_id":"38f2fd98-944d-4899-a7ba-01ff8d641733","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Wm-dova maps for accurate polyp highlighting in colonoscopy: Validation vs. saliency maps from physicians,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:bda55bef7193ada7dcd74ad01f1562fb02cc41f0b72547abbe513d54a9d2fe93","observation_id":"db740aed-a094-4b5a-9a89-b755d2fe5330","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Kvasir-seg: A segmented polyp dataset,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:115c546fe3d253b88be26284bb67263b19491000d24cdfdf330d85041c8fe515","observation_id":"68692913-60d6-44ec-a4b2-f9831c58366b","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Toward embedded detection of polyps in wce images for early diagnosis of colorectal cancer,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:a4f50662b49bd4479cb9c4eff1364f7c1019ee5f65faaea7cc7539b68acee821","observation_id":"6ed0cb97-ddcb-4b3e-ae5a-9f9e5cfc4155","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Inf-net: Automatic covid-19 lung infection segmentation from ct images,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:ebf559e37909101166462da486b18a9c12dc5f2b34cbb3b76742f144710f1eb0","observation_id":"27a50462-a147-4580-8e42-40d79a5017d9","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Dataset of breast ultrasound images,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:732c4381b3a957a749a003c7a5ad0ceecfa2ebf772f87353b360cf8c126e7e89","observation_id":"af552bb9-34f4-4976-8355-c1900d2e413b","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.03368","last_updated":"2019-03-29T17:36:27Z","snapshot_observed_at":"2026-07-06T07:32:06.461067Z","submitted_at":"2019-02-09T04:18:10Z","title":"Skin Lesion Analysis Toward Melanoma Detection 2018: A Challenge Hosted by the International Skin Imaging Collaboration (ISIC)","version":2},"cited_work":{"arxiv_id":"1902.03368","doi":"10.48550/arxiv.1902.03368","metadata_source":"pith","pith_arxiv_id":"1902.03368","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Skin Lesion Analysis Toward Melanoma Detection 2018: A Challenge Hosted by the International Skin Imaging Collaboration (ISIC)","venue":"cs.CV","work_id":"a1680554-54cc-449f-aa92-0acb940cad0a","year":2019},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"cited_paper":"/paper/1902.03368","citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:be189866d4bdc5069587e232d39355b4ad0a602bb5e89877004530cc616b10dd","observation_id":"703156e7-0161-48cc-aba9-4f7d3b9afbad","resolution":{"observed_at":"2026-07-03T00:07:27.838104Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Structure- measure: A new way to evaluate foreground maps,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:47c3df26d7c82e5e4784d794fbeb524865f89413cc7896181b3db2c2c8096f26","observation_id":"72d4bd6a-ff18-48a8-8c66-366966334dbc","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Frequency- tuned salient region detection,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:e68e91a794eac63e0a7ebad5a00ff0914eda7b3d6cacb62bbd36423eb2c578e2","observation_id":"4223a43f-a7da-444f-a0f5-908f04002bc2","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.10421","last_updated":"2018-07-24T03:04:14Z","snapshot_observed_at":"2026-07-06T06:41:20.547019Z","submitted_at":"2018-05-26T03:29:38Z","title":"Enhanced-alignment Measure for Binary Foreground Map Evaluation","version":2},"cited_work":{"arxiv_id":"1805.10421","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1805.10421","snapshot_observed_at":"2026-07-04T03:19:31.391345Z","title":"Enhanced-alignment measure for binary foreground map evaluation","venue":null,"work_id":"6291c3ac-0ecf-46b2-b1cf-effa3bbc4027","year":2018},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"cited_paper":"/paper/1805.10421","citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:3b4b01c276d078a8242013d1112afb138d098a1174d4cc14fcf251c045cd3e6e","observation_id":"78ce21e6-9bc0-4aa0-ac90-2e10b35b9c05","resolution":{"observed_at":"2026-07-03T00:07:27.840034Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:31:28.553260Z","title":"Saliency filters: Contrast based filtering for salient region detection,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-06-27T17:31:28.553260Z"},"links":{"citing_paper":"/paper/2606.08906"},"observation_digest":"sha256:15e53049da745a98f126078ac6543e9df1106d2d631c842318d779fb41574cea","observation_id":"7e48a758-ce46-4cff-b6a8-7d6c36892a85","resolution":{"observed_at":"2026-06-27T17:31:28.553260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.08906","last_updated":"2026-06-08T01:10:36Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T20:06:36.026968Z","submitted_at":"2026-06-08T01:10:36Z","title":"DifferSeg: Towards Diverse Multimodal Binary Segmentation via Differential Perception and Frequency Guidance"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":88,"verified_exact":12,"verified_fuzzy":0},"total_outbound_references":117},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 100 of 117 outbound references and 0 inbound Pith citation observations for arXiv:2606.08906."}