{"as_of":"2026-08-06T16:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2e7545eb9baeac8909e6f0019fa01f11d5762cdd93bb46b35b8623bdf1320043","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T19:02:14.392628Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.03526/citation-record","integrity":"/paper/2604.03526/integrity","json":"/paper/2604.03526/citation-record.json","paper":"/paper/2604.03526"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Frequency-tuned salient region detection","venue":null,"work_id":"f19e34f8-4b5c-422f-8d79-b1d02c267d84","year":2009},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:3e3d40e41b375b372dd95886550307250bf3746288a95acf6116d2564b1cfa15","observation_id":"0e73a86c-9d03-497c-8c7d-d87dfa9e6603","resolution":{"observed_at":"2026-05-14T03:20:30.838628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training-free open- vocabulary segmentation with offline diffusion-augmented prototype generation","venue":null,"work_id":"2ac6c81b-5b01-4a32-bc42-b012e063eb71","year":null},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:f29834561d2562ac47b48e3ffe40ab000813b03a77fa6989fc56d7edcc5a9804","observation_id":"7937a57a-92e1-4534-bb51-0b4b23aa8087","resolution":{"observed_at":"2026-05-14T03:20:30.846536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grounding everything: Emerging localization properties in vision-language transformers","venue":null,"work_id":"8abe53b3-4720-4e9d-ad50-5afbe5dd605d","year":2024},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:59953630ec1482549943465a8071f2778ad26324543c479f4d5dd1233c7bccfb","observation_id":"a875e699-2482-4d3a-859f-d0fada4d3e7e","resolution":{"observed_at":"2026-05-14T03:20:30.829181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bert: Pre-training of deep bidirectional trans- formers for language understanding","venue":null,"work_id":"148c7567-dffa-4615-8f08-0cf179a65133","year":2019},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:8330819f07fd23c8d22306f5a43008a6b5bb7baf9af716ab604560b47feb0246","observation_id":"b7d2353c-0e50-40b2-9318-d321d2d4a1c9","resolution":{"observed_at":"2026-05-14T03:20:30.833838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":"16a3a520-edb1-4cff-9068-4052225b5d1f","year":2021},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:e737ab1ff023b75da49bd874f37e0721e2c837e273e665ef56ed22e155129dd6","observation_id":"716ea00b-cecf-4afd-8509-f606dd3fe2b5","resolution":{"observed_at":"2026-05-14T03:20:30.677106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Human-like object concept representations emerge naturally in multimodal large language models.Na- ture Machine Intelligence, pages 860–875","venue":null,"work_id":"89f4ccfb-e82e-44c8-bb13-304db389e2cd","year":2025},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:a9c9383bd251482802916afab0df90aed19df1ffde077e22ada2059d6fce8a0b","observation_id":"2b575c6c-945a-4bd5-9a68-b7afec15d460","resolution":{"observed_at":"2026-05-14T03:20:30.702595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fb6f220f-1c77-44cd-8910-e39950801f7f","year":2018},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:b6525fb5f1024ec17c9b542053e71c56c190513b0e03fa505b8e2ceb5aa83776","observation_id":"64d23ebc-dec1-4713-a903-791fb13b487d","resolution":{"observed_at":"2026-05-14T03:20:30.777008Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"38833334-7835-4997-9845-7e01175c0cf5","year":2021},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:af25c5fd8f326cff7432067e15b07ed556b746bea4d2a372faac490203f99312","observation_id":"2d078f41-544f-459a-bed5-e092bf495fd6","resolution":{"observed_at":"2026-05-14T03:20:30.802345Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seqrank: Sequential ranking of salient objects","venue":null,"work_id":"a18ededc-483f-41d0-8b85-3ea6d8a85152","year":1941},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:6c6ff12c454587a62d324b63eab82608bc053f931f8a9f1a4c16848b271ee3f4","observation_id":"cc4dd21f-c95d-43b4-a1e0-db9b0cb0b81a","resolution":{"observed_at":"2026-05-14T03:20:30.798575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep learning-based image retrieval with unsupervised double bit hashing.IEEE TCSVT, pages 7050–7065","venue":null,"work_id":"319872d8-d81d-476a-9026-7666b901e590","year":2023},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:84a69231ab014deee9446c7939e070c597bb65ce2a7832f7c10cca961cdff46d","observation_id":"9e41329e-1959-4c67-8415-7105a28a0968","resolution":{"observed_at":"2026-05-14T03:20:30.820414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cnns-based rgb-d saliency detection via cross-view transfer and multiview fu- sion.IEEE Transactions on Cybernetics, pages 3171–3183","venue":null,"work_id":"3e853b10-adeb-4cc7-9f26-a3fd1420280d","year":null},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:fa8b69035cc2e5f5cc28b09e393753560b46732631ed7702bd2e0908ec9d0c52","observation_id":"7c704c05-aca5-4b14-8ddd-ee539861b3fb","resolution":{"observed_at":"2026-05-14T03:20:30.654786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Modeling context in refer- ring expressions","venue":null,"work_id":"7445d6de-65c6-437c-8ba7-8e2523b83371","year":2016},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:6f6f80637b1bb522a89698e61b56326b73234c3e482221383dce20400c00d494","observation_id":"978989fb-5749-4f34-b7db-a028995edf3c","resolution":{"observed_at":"2026-05-14T03:20:30.663449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Densely connected parameter- efficient tuning for referring image segmentation","venue":null,"work_id":"53491734-af31-496b-b97a-b535994378b7","year":2025},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:fc65a0859c3259134063a34397035abfc620f72ca85e383e30fdcb2f006341bd","observation_id":"c36ed30e-5bf3-4778-b467-acb44ace4ebd","resolution":{"observed_at":"2026-05-14T03:20:30.816619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Distilling spectral graph for object-context aware pen-vocabulary semantic segmen- tation","venue":null,"work_id":"2df24f79-b326-43c3-881c-48888886eb37","year":2025},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:b348a10fe5e1e5b9a35197bef01ac532d83ae236157b477dd378f18028283939","observation_id":"d328d4e0-9e9e-4e85-b114-e9774dc470ba","resolution":{"observed_at":"2026-05-14T03:20:30.790081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Berg, Wan-Yen Lo, Piotr Doll ´ar, and Ross Girshick","venue":null,"work_id":"e3555759-e71e-4bd7-aa89-a5148cdd735e","year":2023},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:5031901a1b81d7351494240ca4f7f999d8288208b527b6215c006ea38ebea610","observation_id":"47f42109-159d-47ae-a02d-70af2bcb48a7","resolution":{"observed_at":"2026-05-14T03:20:30.689640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clearclip: Decom- posing clip representations for dense vision-language infer- ence","venue":null,"work_id":"e10546b5-c592-4945-bd06-c893b5f5e473","year":2024},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:3b0e612114ffac138d4768d54d1b63787b46fd75c6221980cbb2679523b65109","observation_id":"0e8973a5-8918-4bf3-a526-defcda66d617","resolution":{"observed_at":"2026-05-14T03:20:30.685352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual saliency based on multi- scale deep features","venue":null,"work_id":"da323147-446d-49b1-bfed-c9e378f8e531","year":2015},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:237ba7bef4ab8efe7735c4fdc01dff564226e70254ffff77e035759eb8f7a97f","observation_id":"e7c8ca99-5eb3-4083-a82e-dbbdce2e9ed7","resolution":{"observed_at":"2026-05-14T03:20:30.794390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":"b5f3ae7f-16d3-4cc3-890f-abc524bedcb2","year":2022},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:8f6e9a2c8ea1af6f295795e16433edacdb73d166b7f62a4766bc8371d3cb464e","observation_id":"f31d7f9a-4ef6-4ce5-b570-e20527bb3e2e","resolution":{"observed_at":"2026-05-14T03:20:30.659518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rehg, and Alan L","venue":null,"work_id":"1857d6cb-1314-432a-a57c-3b5aaff76abf","year":2014},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:5b471e01940a7d1bb77f57f9045794fdf88337e5a628ece20c81a1d1f6cc6bfc","observation_id":"7cee84c2-eebf-4114-9184-179bd275639e","resolution":{"observed_at":"2026-05-14T03:20:30.755480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flip: Scaling language- image pre-training via masking","venue":null,"work_id":"04396d01-d74e-48fa-9485-d01fb08df016","year":2023},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:38f836d2b62a2f7ac741475fe38ad47aef04e918a93e8892c04b2c6184668c14","observation_id":"dfbfffd6-e2c1-48d8-8bb4-5ca4ef2da7f6","resolution":{"observed_at":"2026-05-14T03:20:30.746875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instance-level relative saliency ranking with graph rea- soning.IEEE TPAMI, pages 8321–8337","venue":null,"work_id":"ed2f9109-ce2f-4610-8adf-0ea0f44a58d6","year":2021},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:c5a33d16a8de3877624e667ee672e63fe4d910bb3be72776bff363430a745ed8","observation_id":"d475b2da-a312-474b-8677-1735f914b3f9","resolution":{"observed_at":"2026-05-14T03:20:30.668079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual saliency transformer","venue":null,"work_id":"302c97e3-5b80-49db-a4c4-9b93b482577c","year":2021},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:65b71689d7f084425ba0f4a8252c9eea8de9dc970710838c970f6192bbdd7e42","observation_id":"01e5195e-002f-4083-8376-359e76e28380","resolution":{"observed_at":"2026-05-14T03:20:30.842283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"451894f9-e29a-4ad4-b98d-df4f76e68774","year":2021},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:97b4c983de591d98283b073768e11494a47a822cbbb44f2e01ae53d3f77f145f","observation_id":"877b5893-e89a-423b-853d-8c929b211b36","resolution":{"observed_at":"2026-05-14T03:20:30.773022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Segclip: Patch aggregation with learn- able centers for open-vocabulary semantic segmentation","venue":null,"work_id":"bfed9e95-1eda-49db-be1c-535c0bc3892f","year":2023},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:acf642e30f600c26d43f6bedccb63b7d329d86ceed759a414da8cb1eafbc5d60","observation_id":"91885714-c536-4a89-b0ce-80915484dfa7","resolution":{"observed_at":"2026-05-14T03:20:30.649875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generative transformer for accurate and reliable salient object detection.IEEE TCSVT, pages 1041–1054","venue":null,"work_id":"db4d6c86-b3c8-4294-b21b-e9fed6fa8fa8","year":2025},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:24a95c8ca3eeedc73d3e6469ea809e5c674a6cbf78f79c507d6e51446e540b5e","observation_id":"583e1ad2-513a-46e2-8bee-414f8cd4f61f","resolution":{"observed_at":"2026-05-14T03:20:30.781119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision-aware text features in referring image segmentation: From object understanding to context understanding","venue":null,"work_id":"1c66ebf9-43fd-4254-a527-9ffe035afe3f","year":2025},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:b0c2709307d506e0d7e349f0ea17bc0021be89a97957bce99c66039a93c44eaf","observation_id":"b874ab22-b690-4a89-bc09-5d560e9abe24","resolution":{"observed_at":"2026-05-13T19:03:09.234412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eov-seg: Efficient open-vocabulary panoptic segmentation","venue":null,"work_id":"6f14fa09-7476-402d-bdf8-daf00a21ceac","year":2025},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:608bd3a9482f93132ac794589ae5801cb04b82bffdba1d8052f1b4aad53f5e5f","observation_id":"027a89dd-1ca4-4db8-97c5-01113bd89ae9","resolution":{"observed_at":"2026-05-14T03:20:30.711820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chatgpt","venue":null,"work_id":"2fc5875c-e79f-44df-8560-abf4896b46bb","year":2023},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:b635a65ae052f6f9536b004f8219d217f89adc6084d8f162758707fd2f2913f8","observation_id":"d04516d7-ac92-484f-bca0-06520427e26e","resolution":{"observed_at":"2026-05-14T03:20:30.721063Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-scale in- teractive network for salient object detection","venue":null,"work_id":"d55a0df8-1f5c-4a04-9e7f-b633aaf3339b","year":2020},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:bc2667e6e050251bcd8d213b2159ee85014491b00d0ef6a2b92779f9fe97319d","observation_id":"f18c78ab-48db-46db-a30e-8313f061c495","resolution":{"observed_at":"2026-05-13T19:03:09.236326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hypersor: Context-aware graph hypernetwork for salient object ranking.IEEE TPAMI, pages 5873–5889","venue":null,"work_id":"8d2b4466-e49e-4b84-9023-97868d3b097d","year":2024},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:b0d2137859427323965284544cf4b7a603203a71e05c2506d4be2d4810d1cec3","observation_id":"e3fea1aa-4df5-40bb-bcc8-68cad0effc64","resolution":{"observed_at":"2026-05-13T19:03:09.227431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"426bec91-946a-4f3e-b826-b1d83be0d450","year":2021},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:dd74e2ae7a0a42dabe491d74df6be8682e1671a1bb43e55ea62c4b90c3e005f9","observation_id":"a940a289-c0f6-4c69-86ff-aef8e746ce28","resolution":{"observed_at":"2026-05-13T19:03:09.229172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unifying global-local representations in salient object detection with transformers.IEEE TETCI, pages 1–10","venue":null,"work_id":"e9a26510-e355-4cd9-b1fe-9ab2a77be4b6","year":2024},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:20a68f81fb33c44cf0a3f88749c32e0622781955474153b9d1cec6036ed73e40","observation_id":"f4195629-5fc7-4038-9f4f-2b7fc134b385","resolution":{"observed_at":"2026-05-14T03:20:30.673231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pushing the boundaries of salient object detection: A denoising-driven approach.IEEE TIP, 34:3903–3917","venue":null,"work_id":"a023d50d-43b2-43d5-9602-cb39e2f8d804","year":2025},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:e0dc1fd3d7990028db1f8d65867d8a3631856f54f312a819e558473f116d5336","observation_id":"7db8630c-5024-44fb-899b-0133149b3600","resolution":{"observed_at":"2026-05-13T19:03:09.232609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Partitioned saliency ranking with dense pyramid trans- formers","venue":null,"work_id":"c966cefb-14b1-4f73-bb99-0048a1046f66","year":2023},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:23bd702bca2e95762ef6faaceed33d88c815dbcf5a7835f01c20df09c8160b32","observation_id":"63939ab3-7bcc-4aef-bb88-d96737090967","resolution":{"observed_at":"2026-05-13T19:03:09.219539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Conditional diffusion models for cam- ouflaged and salient object detection.IEEE TPAMI, pages 2833–2848","venue":null,"work_id":"9a788906-fd54-4687-973e-70bd2c83dac3","year":2025},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:904e1c5f8f4a0bb43c4f3f9ccba4bc77c125d86c8c33f8c4912a6b9f1615caaa","observation_id":"8206ab21-6a9b-43e3-bcda-7e58f9b08fa5","resolution":{"observed_at":"2026-05-13T19:03:09.221511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Con- trastive grouping with transformer for referring image seg- mentation","venue":null,"work_id":"f6b3cd55-4e5e-42df-8d18-69bf64affb02","year":2023},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:7c8f0769e35c55d2573b856610dfef558f48c3ca106bf1f61c51679f8c2b9036","observation_id":"970d85de-7152-423e-9768-cce0c56839f7","resolution":{"observed_at":"2026-05-13T19:03:09.223398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bi-directional object-context prioritization learning for saliency ranking","venue":null,"work_id":"3bebc1d5-5a7a-4e34-ac53-ab4f5a14d716","year":2022},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:a244bea0a54dea4fe46902e1f432089c500aba5a75694ee0fa6ea685af5dd063","observation_id":"5de7a64d-092f-41e0-8259-e44f98231d43","resolution":{"observed_at":"2026-05-13T19:03:09.225528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yolov8 documentation","venue":null,"work_id":"11715d67-87a1-46d4-821e-71eef6744759","year":2023},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:be0dc7777f1d669181037c86cfe69a4444f87aba1bea01083a5669edce184750","observation_id":"3ed1854b-c00b-4873-a985-1956798b8430","resolution":{"observed_at":"2026-05-13T19:03:09.230820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sclip: Rethinking self-attention for dense vision-language inference","venue":null,"work_id":"1d15eabf-53ae-4b4a-b06a-89ffd2990f7e","year":2025},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:9bb28e7586af76f8aab8c381a399a7f4acdb8ec24745a7f72ac0f45b510b42a5","observation_id":"7e050519-97aa-40f9-8c02-529e4bc373f6","resolution":{"observed_at":"2026-05-13T19:03:09.238038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Declip: Decoupled learning for open- vocabulary dense perception","venue":null,"work_id":"c48305d3-7dbe-4fbc-b13c-b9e49da91203","year":2025},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:6ef99a26b97d030c3472712f9102d37357a1a6ead55fe4db37047c93e694bf0f","observation_id":"27581717-d294-4401-9e93-ba1cd548f779","resolution":{"observed_at":"2026-05-14T03:20:30.751144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to de- tect salient objects with image-level supervision","venue":null,"work_id":"f86c0710-f696-4bb6-94ce-a11ccbc4e9ad","year":2017},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:b4cd22eef5d7ccb00db1a7567b25ee024d51cb863c1c11907001a49ebd3e24b4","observation_id":"47b52750-5d0f-4d26-9792-a782e72b2e89","resolution":{"observed_at":"2026-05-14T03:20:30.763554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pixels, regions, and objects: Multiple enhance- ment for salient object detection","venue":null,"work_id":"8cedc920-c058-4e60-b226-1c509521951f","year":2023},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:d49f9928dc6b56f2d750e540039ca9047eddebda52e567742eefe013b60a5bd3","observation_id":"2830334b-f57b-4820-8126-aaec18544f4d","resolution":{"observed_at":"2026-05-14T03:20:30.724926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Iterprime: Zero-shot referring image segmen- tation with iterative grad-cam refinement and primary word emphasis","venue":null,"work_id":"c79ffa0f-30f6-44d9-ad4e-4bb6c863773d","year":2025},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:226920511fe5252614a83a0209baad4797de9cb2b75769e2a91fc2587e2ae3eb","observation_id":"db70ca1d-b356-4471-bb02-10d641047e49","resolution":{"observed_at":"2026-05-14T03:20:30.807677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Medsegdiff-v2: Diffusion-based medical image segmentation with transformer","venue":null,"work_id":"1b3f2c62-1100-429b-9b8a-2fe069626d6e","year":null},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:c834eddf0d8623f1a4166419a342909eebe0387a618efcf535d5bc0c4d984a3b","observation_id":"777906ac-283d-4562-92d0-67fbd3d34a53","resolution":{"observed_at":"2026-05-14T03:20:30.693884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mobilesal: Extremely efficient rgb-d salient object detection.IEEE Transactions on Pattern Analysis and Machine Intelligence, pages 10261– 10269","venue":null,"work_id":"2b9bb214-d3c4-4370-b3c3-66219f723748","year":2022},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:0e66111b190f40be304a532960c255d64c9157f767b19b9e0f64a89692e7be3f","observation_id":"19e2d8c6-4249-4cfd-af02-fa1c0362bed8","resolution":{"observed_at":"2026-05-14T03:20:30.768168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Edn: Salient object detection via extremely-downsampled network.IEEE Trans- actions on Image Processing, pages 3125–3136","venue":null,"work_id":"c9da6b0e-1e2d-4a5d-9e15-c21e73e33882","year":2022},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:cd52f883b698a5a006aeca1a2ea3803060344e0358a869c4da15c9a7009efc6f","observation_id":"b6362e93-b241-4cf4-8d0e-6cc7f738571d","resolution":{"observed_at":"2026-05-14T03:20:30.707417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gsva: Generalized segmentation via multimodal large language models","venue":null,"work_id":"e5e6df53-4e38-48f4-8fa3-b7c43a60828d","year":2024},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:27fcd82ef49d71e374b6c554d4ccf1e8c0f75656a69ea1136222a60cb350e6cd","observation_id":"cc7d67b1-125b-4021-8ae4-2a37c3ad36f9","resolution":{"observed_at":"2026-05-14T03:20:30.824407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bridging vision and language encoders: Parameter-efficient tuning for referring image seg- mentation","venue":null,"work_id":"95a9c125-e21c-4700-b719-b3bc9c2e966f","year":2023},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:26860aadf05570b381a5311a279089363f54b4bf8d6e951d9eba24baf6c1c7df","observation_id":"1ae76fa7-ae05-47d3-8e86-2e1e6bc7d580","resolution":{"observed_at":"2026-05-14T03:20:30.697710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generalized decoding for pixel, im- age and language","venue":null,"work_id":"b7ad45f2-dc37-4de0-bc10-4a285b64bb6a","year":2023},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:08c854d664f4b28f8e6a0afa963bcafa2ac9f9088e15f66beea84ad9fca1e3f6","observation_id":"12d402b2-a670-4099-a06d-377849a3bd4f","resolution":{"observed_at":"2026-05-14T03:20:30.737652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hierarchical saliency detection","venue":null,"work_id":"a8e82cc1-2512-4929-bfa0-bf7ba5555a6d","year":2013},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:221cef63e849acac698548bb0d99b2ee4f92af1111740f6f614f5c547cb8af21","observation_id":"7911581f-dcb6-4527-b031-489847e23810","resolution":{"observed_at":"2026-05-14T03:20:30.759481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Remamber: Referring image segmentation with mamba twister.ECCV, pages 108–126","venue":null,"work_id":"30aebaa2-e851-4f99-a575-79c9e4ee8ee2","year":null},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:a9a1abead20e87a973de23a0a546d83b69ca2652491ca40c33b980d99b583db5","observation_id":"606f3a86-20fd-41ae-85e6-583234a65306","resolution":{"observed_at":"2026-05-14T03:20:30.729162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating salient object detection in natural images with multiple objects having multi-level saliency.IET Image Processing, 14(10):2249–2262","venue":null,"work_id":"fbc51b48-e2c0-4be2-8c3c-244c32d5d14a","year":2020},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:fff417b6e47d745d3e7357a1c37293166cb5383f77b2a23a2f21456f7ce1b6d0","observation_id":"0246aae2-d28e-49f5-b1b6-c176b493ca61","resolution":{"observed_at":"2026-05-14T03:20:30.716491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unified unsupervised salient object detection via knowledge transfer","venue":null,"work_id":"e5aca60e-1635-489f-897d-176488c59718","year":2024},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:f8cef0db855721ecda50ac612997d31f74146e72e4e2436c97df69b9fb3c3e46","observation_id":"e8773864-267b-4817-85cc-274c149ec0dc","resolution":{"observed_at":"2026-05-14T03:20:30.681283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaptive se- lection based referring image segmentation","venue":null,"work_id":"90909112-6e88-4a79-af87-25784baa33ea","year":2024},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:c6f96a93c8e1cce7c86464534a90b541e198b6cde2d1a0b47f832176d3014c51","observation_id":"6f359ed0-62a4-4ce2-8add-4bd44993a837","resolution":{"observed_at":"2026-05-14T03:20:30.785384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Position fusing and refining for clear salient object detection.IEEE TNNLS, pages 4019–4028","venue":null,"work_id":"d502d6f7-8ea9-4756-a07f-2573b03b6526","year":2025},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:0316a2c123fcdae1000d34e35cc3975f79577eb545b4f41de61ed98d05426144","observation_id":"b3ecc8a6-1eff-4810-abb1-bbe09f89a7f2","resolution":{"observed_at":"2026-05-14T03:20:30.645232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Texture-guided saliency distilling for unsuper- vised salient object detection","venue":null,"work_id":"81106821-90af-4f9c-9a84-8610dd726bb6","year":2023},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:5fb420a2a0d93cdbc60e9253baa61f9c966c74c0ac64c15bad2f9f93d7c6c3eb","observation_id":"e47a0813-ae40-41d4-a853-a412664113ab","resolution":{"observed_at":"2026-05-14T03:20:30.733461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Priornet: Two deep prior cues for salient object detection.IEEE TMM, pages 5523–5535","venue":null,"work_id":"f2701918-7abe-4794-b3e4-16df193e05e3","year":2024},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:49d1cb83559df323d25c2805249450f9105c272f1b02628be6d489e2aec6b879","observation_id":"5a5edd36-562a-40c7-a283-989571273f87","resolution":{"observed_at":"2026-05-14T03:20:30.812383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mlst-former: Multi-level spatial-temporal trans- former for group activity recognition.IEEE TCSVT, pages 3383–3397","venue":null,"work_id":"2eb42297-f0dd-4994-b6d2-5d081b83e888","year":2023},"citing_paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-13T19:02:14.392628Z"},"links":{"citing_paper":"/paper/2604.03526"},"observation_digest":"sha256:2960ec29298574cd3e18018b868490338721f7a0bf037cff5a48a9b4cf3c78a3","observation_id":"c24723b6-a1dd-4157-926c-fa74b8bc0531","resolution":{"observed_at":"2026-05-14T03:20:30.742435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.03526","last_updated":"2026-04-04T00:10:33Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:52:43.685366Z","submitted_at":"2026-04-04T00:10:33Z","title":"Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":2,"verified_exact":0,"verified_fuzzy":55},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2604.03526."}