{"as_of":"2026-08-08T07:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4971f6944afc485d4d0fe7e6594f515725118e1a94768e277472d86aeefbd50e","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:44:00.325185Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-02T15:11:57.228949Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T15:17:07.293578Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"cited_work":{"arxiv_id":"2505.17796","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17796","snapshot_observed_at":"2026-07-02T15:17:07.293578Z","title":"Detailfusion: A dual-branch framework with detail enhancement for composed image retrieval","venue":null,"work_id":"d415ef21-b8d2-49a1-b913-b18b9b32c0f6","year":2025},"citing_paper":{"arxiv_id":"2604.05393","last_updated":"2026-04-07T03:43:01Z","snapshot_observed_at":"2026-07-06T22:54:08.897942Z","submitted_at":"2026-04-07T03:43:01Z","title":"Beyond Semantic Search: Towards Referential Anchoring in Composed Image Retrieval","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T19:42:23.224746Z"},"links":{"cited_paper":"/paper/2505.17796","citing_paper":"/paper/2604.05393"},"observation_digest":"sha256:d751c4cbf18a230a357ba81a803f0d90a0ef017c6ac1cf28456799588086cd1f","observation_id":"62f33b34-ac4b-4a13-afc3-b858cd40f836","resolution":{"observed_at":"2026-05-10T22:35:50.487903Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"cited_work":{"arxiv_id":"2505.17796","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17796","snapshot_observed_at":"2026-07-02T15:17:07.293578Z","title":"Detailfusion: A dual-branch framework with detail enhancement for composed image retrieval","venue":null,"work_id":"d415ef21-b8d2-49a1-b913-b18b9b32c0f6","year":2025},"citing_paper":{"arxiv_id":"2604.09114","last_updated":"2026-04-10T08:50:47Z","snapshot_observed_at":"2026-07-06T22:58:04.106299Z","submitted_at":"2026-04-10T08:50:47Z","title":"FIRE-CIR: Fine-grained Reasoning for Composed Fashion Image Retrieval","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:25.983511Z"},"links":{"cited_paper":"/paper/2505.17796","citing_paper":"/paper/2604.09114"},"observation_digest":"sha256:82448c8e841444459b3dfccc47c231dc65c393bc4a2ed2a9ab7e86cbd8d5fb3f","observation_id":"bd154788-16db-4ba3-92d1-516fb324fc4e","resolution":{"observed_at":"2026-05-11T05:21:00.335945Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"cited_work":{"arxiv_id":"2505.17796","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17796","snapshot_observed_at":"2026-07-02T15:17:07.293578Z","title":"Detailfusion: A dual-branch framework with detail enhancement for composed image retrieval","venue":null,"work_id":"d415ef21-b8d2-49a1-b913-b18b9b32c0f6","year":2025},"citing_paper":{"arxiv_id":"2606.30217","last_updated":"2026-06-29T12:30:24Z","snapshot_observed_at":"2026-08-03T23:12:01.383471Z","submitted_at":"2026-06-29T12:30:24Z","title":"Before Thinking, Learn to Decide: Proactive Routing for Efficient Visual Reasoning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-30T05:55:19.083517Z"},"links":{"cited_paper":"/paper/2505.17796","citing_paper":"/paper/2606.30217"},"observation_digest":"sha256:204e9c3188b890d92db8743f5c3431b071253bf022b9ed142418e936c23856a7","observation_id":"3187ab66-df64-4504-9f9a-022ebd5919aa","resolution":{"observed_at":"2026-06-30T13:34:41.178587Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"cited_work":{"arxiv_id":"2505.17796","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17796","snapshot_observed_at":"2026-07-02T15:17:07.293578Z","title":"Detailfusion: A dual-branch framework with detail enhancement for composed image retrieval","venue":null,"work_id":"d415ef21-b8d2-49a1-b913-b18b9b32c0f6","year":2025},"citing_paper":{"arxiv_id":"2607.00374","last_updated":"2026-07-01T03:20:06Z","snapshot_observed_at":"2026-08-07T17:15:46.303275Z","submitted_at":"2026-07-01T03:20:06Z","title":"Learning to Compose: Revisiting Proxy Task Design for Zero-Shot Composed Image Retrieval","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-02T15:11:57.228949Z"},"links":{"cited_paper":"/paper/2505.17796","citing_paper":"/paper/2607.00374"},"observation_digest":"sha256:6b22afe3ac70e9e6f3d31433924de870ff294d91a02452f078000f2d472e2d7d","observation_id":"dde27b49-0cd2-40f4-8b20-4e4842d4db26","resolution":{"observed_at":"2026-07-02T15:17:07.294917Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17796/citation-record","integrity":"/paper/2505.17796/integrity","json":"/paper/2505.17796/citation-record.json","paper":"/paper/2505.17796"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:53.147868Z","title":"Composing text and image for image retrieval-an empirical odyssey","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.147868Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:17b1ed7e80932d0423129ae709afc2cafc054b2060c65bf5ceb7a3f2df3923fc","observation_id":"c3f745a7-6620-4930-a497-26cd3de8e8cb","resolution":{"observed_at":"2026-08-07T14:43:53.147868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:53.269842Z","title":"Image retrieval on real-life images with pre-trained vision-and-language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.269842Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:959d45c02937e4929af21a203d2676f7f55a5ccf9b083a9640d15a0ac0b9ae8e","observation_id":"050ff53f-ca7e-4e67-8a9c-6e18af744329","resolution":{"observed_at":"2026-08-07T14:43:53.269842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:11.281115Z","title":"Deep image retrieval: Learning global representations for image search","venue":null,"work_id":"6d37c00b-2ddf-449d-9d26-380d2816728d","year":2016},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.412796Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:f0ddeb7ffea0b72fce8a81989d35fe344d83e5b6cd26026235ec1f294e1c5159","observation_id":"09ffaa7a-d00b-4ccb-9332-09ad7fb1d5ae","resolution":{"observed_at":"2026-08-07T14:44:11.378843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:11.025257Z","title":"Large-scale image retrieval with attentive deep local features","venue":null,"work_id":"9c0a7755-5ac4-46cf-9600-45ed6359b6f1","year":2017},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.497335Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:356172504ccf0ed7f65a587d0cc992487bad22b46ccc07bb13fd570e344bef1c","observation_id":"9a064fdf-4ce3-4d1f-92eb-5bcfa52d337e","resolution":{"observed_at":"2026-08-07T14:44:11.156029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:10.784899Z","title":"Camp: Cross- modal adaptive message passing for text-image retrieval","venue":null,"work_id":"00a411fa-93f3-470c-87f0-a98c680af359","year":2019},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.615652Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:e49f38d3bb5a1a910d1a221bda8ebb8a4065c336cab7c72ed6a0ab01bd41d3bc","observation_id":"df64123b-daf0-4580-8900-7292ea28ee06","resolution":{"observed_at":"2026-08-07T14:44:10.902901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:10.584424Z","title":"Context-aware attention network for image-text retrieval","venue":null,"work_id":"63eb1a03-7d0f-4d09-bde2-22b4083af4f8","year":2020},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.731224Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:d70c2869a02f8fb4d1a96d74ac00ee2fe74cec8b4365b40bc69dea2dddad5d1d","observation_id":"b9a9b2aa-5d4d-4ded-89ce-fdac6a4ff7de","resolution":{"observed_at":"2026-08-07T14:44:10.680723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:10.409230Z","title":"Image search with text feedback by visiolinguistic atten- tion learning","venue":null,"work_id":"6859ffcc-3194-4426-8bd5-3872b3ca78e7","year":2020},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.829475Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:56f5279de8912988277853e2ee5a06a336d4d6f63cdbff2d048c488340512958","observation_id":"e40c7bdc-7a53-4429-8f9c-121747b9f438","resolution":{"observed_at":"2026-08-07T14:44:10.485470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:53.907146Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:53.907146Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:cbdadd577688069b25506a262cce203f74dacec1f77acc349c84d479f22db9ea","observation_id":"eca6e02a-5b37-4837-a57e-122b1ee06f1c","resolution":{"observed_at":"2026-08-07T14:43:53.907146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:54.016817Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.016817Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:d964ffb4afb00a5d0cce8a1b695e67fb6b97008c1883e07069eeb1b5e3362f45","observation_id":"41253191-9e28-4fa7-8213-7b26ecefd9c9","resolution":{"observed_at":"2026-08-07T14:43:54.016817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:54.068697Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.068697Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:5d61b73676723156ee4db8e7cd1252fc7e508a61e86bfe3c8278fd963722e91b","observation_id":"5d48ad48-aacb-441a-b19b-c54f3fbf265c","resolution":{"observed_at":"2026-08-07T14:43:54.068697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:54.122955Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.122955Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:9fc1d6257a8dff1b89d9501367d98369d1e2c88b4fec008f01f910739beca205","observation_id":"f5b3f5c2-4c71-4ebf-822e-43d7f07f96a0","resolution":{"observed_at":"2026-08-07T14:43:54.122955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:10.199416Z","title":"Artemis: Attention-based re- trieval with text-explicit matching and implicit similarity","venue":null,"work_id":"c3da5d22-9526-40df-85c8-4e4911c1bbb4","year":2022},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.185826Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:0c9c544c4667c4e6d4474109ed7d66c69a286ab82ecbd4743f4c915f250c5162","observation_id":"63dc7c68-34fa-4156-afdc-b72d22a0e176","resolution":{"observed_at":"2026-08-07T14:44:10.292713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:10.046388Z","title":"Compositional learning of image-text query for image retrieval","venue":null,"work_id":"48cdb9c6-8a18-482b-956e-eb39107908e0","year":2021},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.278775Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:b38cbca6db1bc23b7cd102e45095e99f1139d6a8c029d2312ab8a44b7b3ffc3c","observation_id":"dfbcde8f-8345-4f90-9279-b91d1d312b02","resolution":{"observed_at":"2026-08-07T14:44:10.107308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:54.388946Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.388946Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:ad4f43319d164b27867fe4d671c48d9ca2005fadd65e3daf005f6b38781666ce","observation_id":"eec2f1eb-4ae4-4b12-a5cb-d5148253ba81","resolution":{"observed_at":"2026-08-07T14:43:54.388946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:09.880307Z","title":"Spirit: style-guided patch interaction for fashion im- age retrieval with text feedback.ACM Transactions on Multimedia Computing, Communications and Applications, 20(6):1–17, 2024","venue":null,"work_id":"81b4b6e3-441a-47f9-b997-0cbd6423a360","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.455210Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:78e409326c96a4ecbb112a61e8bf0319193d0a8cd9557a2eac0972f7c060414d","observation_id":"30b41aeb-4385-42fe-8031-3d77e162324d","resolution":{"observed_at":"2026-08-07T14:44:09.949637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:09.687622Z","title":null,"venue":null,"work_id":"9106285e-b2d3-4ed7-908a-bb8a9ccb0ce3","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.589003Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:29bf36f3b0eb4056ad997bf82417cff021d421df513a4c3d34332af69752f081","observation_id":"7e91d982-7f84-42ca-b060-229d6096fe38","resolution":{"observed_at":"2026-08-07T14:44:09.775330Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:09.518154Z","title":"Data roaming and quality assessment for composed image retrieval.Proceedings of the AAAI Conference on Artificial Intelligence, 38(4):2991–2999, Mar","venue":null,"work_id":"edc17c95-f61a-4eab-94a0-653f168f531e","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.700670Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:bcad4e73d3fc05eb7a43ed1f2c79d7948d18d3de954dae35e9aa591911e3a618","observation_id":"9d37f5e2-7296-4096-9a8b-9fa45cc6c8c2","resolution":{"observed_at":"2026-08-07T14:44:09.584047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:09.325535Z","title":"Candidate set re-ranking for composed image retrieval with dual multi-modal encoder.Transactions on Machine Learning Research, 2024","venue":null,"work_id":"f55c48cd-8a9a-4a16-a905-46bbd391ff02","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.766710Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:87fb997f18328e287c3a9554f8b8ac1f8ebc6dae695e8c65ecde5d295489803f","observation_id":"bf4a2ef7-7d93-4c1d-8141-bed5f2f3f566","resolution":{"observed_at":"2026-08-07T14:44:09.416048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:09.145768Z","title":"Simple but effective raw-data level multimodal fusion for composed image retrieval","venue":null,"work_id":"35de9efa-db5e-4a32-9303-ba1ab1693930","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:54.885737Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:9b41dc894e8bce9d44ae0e8a2ec040784cf3a0e0edede47b552355fde9ec0a1e","observation_id":"6b45d603-4760-4bbb-86b8-4a9a214e2a85","resolution":{"observed_at":"2026-08-07T14:44:09.252934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:08.879335Z","title":"this is my unicorn, fluffy","venue":null,"work_id":"430eaf7f-d6e2-43f2-b84b-5d503eb80204","year":2022},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:55.038721Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:9d00773ee1683d5e8e21b5c5c1df41f94eb7fdd568f170b92ab422d195ef5292","observation_id":"0c5092be-8b19-487b-9bfd-f6b5064c6466","resolution":{"observed_at":"2026-08-07T14:44:09.005365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:55.237440Z","title":"Effective conditioned and composed image retrieval combining clip-based features","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:55.237440Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:816a48232cd2734028af68d6127dab05e1fd3994d90cf4df8671d11359cda7d9","observation_id":"4705c3f5-524a-4506-b776-e98cb064e6fc","resolution":{"observed_at":"2026-08-07T14:43:55.237440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:08.588921Z","title":"Pic2word: Mapping pictures to words for zero-shot composed image retrieval","venue":null,"work_id":"e4c057b9-6bf7-42b6-980d-c3efb7b8fced","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:55.358238Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:10ac0b3d31a2f9a1bfb6c42152df06f67e5dd47552b2f2276c05da2cbecb5830","observation_id":"5bef2185-90b5-4f09-93f3-984e675cc7e1","resolution":{"observed_at":"2026-08-07T14:44:08.744475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:08.406831Z","title":"Zero-shot composed image retrieval with textual inversion","venue":null,"work_id":"2d450777-bfd9-4978-87ef-a1848e308ec2","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:55.500840Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:aff2323fb10765cce7dcc1cae1dd8824fb266b1435ce554c0cd3f953722cc9d6","observation_id":"8ff4bb9f-ec19-421b-a7fd-8d53d2280d3f","resolution":{"observed_at":"2026-08-07T14:44:08.475036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:08.215252Z","title":"Sentence-level prompts benefit composed image retrieval","venue":null,"work_id":"fc70910d-6214-4e10-a8ff-401bff254754","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:55.635822Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:5e73de234417ee2e5bb6b641cf89b1c41f9af5af7569f07682ddc45d41649c0c","observation_id":"c82aea50-fd75-42eb-a2da-79d6da7a2658","resolution":{"observed_at":"2026-08-07T14:44:08.311428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:07.995990Z","title":"Covr: Learning composed video retrieval from web video captions.Proceedings of the AAAI Conference on Artificial Intelligence, 38(6):5270–5279, March 2024","venue":null,"work_id":"317bddcf-5e7b-4275-8e0a-4fd28fdf9bc2","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:55.794370Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:750406e7ca1cf16d14ee3bf554b56f6500451d04ad35191ba1f6d5c5a30ef20e","observation_id":"57ee9fc1-2ec6-4341-a272-be189cd3326a","resolution":{"observed_at":"2026-08-07T14:44:08.114923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:07.644069Z","title":"MagicLens: Self-supervised image retrieval with open-ended instructions","venue":null,"work_id":"6aaf227a-79ac-4d1b-bcc5-38c628d24d87","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:55.934833Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:17c8b1f7407d438f4e4dd9f820b061821c3b5a6e3e97f2d7aab9ff602780e83f","observation_id":"4f361353-6858-4db8-923d-26c109fb6067","resolution":{"observed_at":"2026-08-07T14:44:07.784156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:07.381930Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answering","venue":null,"work_id":"63da70a1-d9fb-4945-b341-60dd2bb1a2b6","year":2019},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:56.051137Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:a20530b43c974001dae1beae3cd923394a072d6c61abd35a7e3da71046471b8a","observation_id":"8bc47e73-4f3b-4b83-a68d-7b5af92096db","resolution":{"observed_at":"2026-08-07T14:44:07.509690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:56.175702Z","title":"Frozen in time: A joint video and image encoder for end-to-end retrieval","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:56.175702Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:9f5f9f7603444efeb6fb6b1b142bce6324b998b7671d951009b5d3b6ac38cc2f","observation_id":"6d177c37-97d5-49ad-949a-6b3d9b04378e","resolution":{"observed_at":"2026-08-07T14:43:56.175702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T14:43:56.316244Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:56.316244Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:4be7ac77e23a9cb4c7af5f64e016855cbafe1c308b117249ec10533e955b23b3","observation_id":"83cf44a5-0591-4a16-a258-32d7a3260653","resolution":{"observed_at":"2026-08-07T14:43:56.316244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-07T14:43:56.455799Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:56.455799Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:ff6e7ad4e9e7e5ed7aec2f13c1f6a473472904e52cb979f861718ecd9bca247f","observation_id":"630cfc92-f64d-4f65-9c26-bdfa921a6ed0","resolution":{"observed_at":"2026-08-07T14:43:56.455799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:56.577771Z","title":"Compodiff: Versatile composed image retrieval with latent diffusion.Transactions on Machine Learning Research,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:56.577771Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:97fd509b297bc8eeff142e33fee4fe84c89ea4cac9073c156e684921ceec5f98","observation_id":"e00ec1cb-cbf8-4422-93e4-c61ec0fef7dc","resolution":{"observed_at":"2026-08-07T14:43:56.577771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:07.072535Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"7a5cf9e7-b0ef-4022-9a72-61857f498df8","year":2022},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:56.904411Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:ea14ab7dc48607cd332c206a1b1568db9e62568eb9083a64b4823913c038fffc","observation_id":"62ef6ebe-4e50-4030-9fe6-afae34d8bb0f","resolution":{"observed_at":"2026-08-07T14:44:07.190195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:06.778015Z","title":"Fashion iq: A new dataset towards retrieving images by natural language feedback","venue":null,"work_id":"e2da2585-e41d-459f-8157-64eb8e2170a7","year":2021},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.050870Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:ba0b4481eeedfd8ed7afbd2242e87fd25e11f3c3aa45d080d37d681c871a49a7","observation_id":"7518d2ea-7e47-4bc9-90ec-e6952ea00660","resolution":{"observed_at":"2026-08-07T14:44:06.920687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:06.481228Z","title":"A corpus for reasoning about natural language grounded in photographs","venue":null,"work_id":"f200d6a9-1538-4859-91d6-8844544573d1","year":2019},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.273543Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:e5dc8b5590ff2eb639630651e319a5d139bca23b94afbeed62abb502afaa6bd7","observation_id":"b569a896-eb21-4114-8646-8d7661c07db1","resolution":{"observed_at":"2026-08-07T14:44:06.634343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:06.180100Z","title":"Eva: Exploring the limits of masked visual representation learning at scale","venue":null,"work_id":"b035c48d-ed2c-4e4f-b483-537b285d53c3","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.397727Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:41b57877d78f1ec840c192352c9250c95f9264d26adc6ac393f617af4f2482d2","observation_id":"713d6b88-8a7f-4149-92f8-19308f895bff","resolution":{"observed_at":"2026-08-07T14:44:06.339458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T14:43:57.512568Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.512568Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:0d539823084588cf4d5b178d36ca6c947c62ddf5277bf1c1539e8fd24c0aac74","observation_id":"f1c98d48-8b23-4cb3-a918-c33d820ce731","resolution":{"observed_at":"2026-08-07T14:43:57.512568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:05.883686Z","title":"Improving composed image retrieval via contrastive learning with scaling positives and negatives","venue":null,"work_id":"aa5b1413-80fc-46da-9671-266a4380a07c","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.612935Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:82ea1cb963d50d7b6ed7893edb03eda1b23d3b5492bd0f86daf31fce51c1385c","observation_id":"0626241b-c2fe-4f60-b165-22bf43f4fc91","resolution":{"observed_at":"2026-08-07T14:44:06.005802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:05.506594Z","title":"Decomposing semantic shifts for composed image retrieval","venue":null,"work_id":"a35cbc30-56d4-42e8-97e4-e1d8838fcc12","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.725883Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:55536b58f940090c48d5afc577613adf6b9d1bdfe8d62017b64857ab273e9888","observation_id":"73eff5d1-aa2a-49d8-a950-2a06c215fde0","resolution":{"observed_at":"2026-08-07T14:44:05.695708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:05.224877Z","title":"Bi-directional training for composed image retrieval via text prompt learning","venue":null,"work_id":"3fcda66f-39f9-4a86-9b77-821063c1ff60","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.813362Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:a5ce85f61a265896b29fe1b66f0f207dbb623f42abeb4e227026a7e27cae1899","observation_id":"9e201731-d041-4d34-9878-a5bd87a2fff5","resolution":{"observed_at":"2026-08-07T14:44:05.326598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:05.017109Z","title":"Cala: Com- plementary association learning for augmenting comoposed image retrieval","venue":null,"work_id":"f2336c7b-45e6-4587-9166-8d1f028d11ca","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:57.875776Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:1f15c3282b87f298ca05e3ed91e5fa537ece6c284dfe3135f4d7c184236c3e34","observation_id":"e204848b-a8ae-488c-b4b8-dbc49a6a05fe","resolution":{"observed_at":"2026-08-07T14:44:05.111600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:04.723957Z","title":"Target-guided composed image retrieval","venue":null,"work_id":"5f74333f-5713-49f0-9a8f-f0932222ddbe","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.013676Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:37b45b2c83fa0322fce78dd9e00094335110a221a475cf48bbb471d8418cf0d2","observation_id":"45f2fad1-e1a1-41a9-9e02-6e7652674d11","resolution":{"observed_at":"2026-08-07T14:44:04.904786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:04.449163Z","title":"Leveraging large vision-language model as user intent-aware encoder for composed image retrieval","venue":null,"work_id":"ae387060-53bd-4237-b836-8f18ac86abe0","year":2025},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.099612Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:76a3f3a9029be89fdf3431093abcc9d282d84a97e4f230347a1272ba19ec5e80","observation_id":"de3a0295-83de-460a-81ed-7e1e94bc366e","resolution":{"observed_at":"2026-08-07T14:44:04.600295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:04.244360Z","title":"Ccin: Compositional conflict identification and neutralization for composed image retrieval","venue":null,"work_id":"94deda1c-9434-4a8d-a33a-d116b2e23e0f","year":2025},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.214233Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:083f4ee39eaa14c8c3e502f6db88aff6849c719d25b4279858cad94805a44b35","observation_id":"abb99c63-a3bb-4a32-872d-132a9da6a7fc","resolution":{"observed_at":"2026-08-07T14:44:04.341700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:03.992801Z","title":"Conditioned and composed image retrieval combining and partially fine-tuning clip-based features","venue":null,"work_id":"e1f4547f-1e88-4bd8-8436-afdf159cb768","year":2022},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.309122Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:f5528a67ba87b85de36967855e6ae26336e0de920233cd2589865aaf5bacf14d","observation_id":"fa910af5-3346-45c4-a797-eebd6c4a1a32","resolution":{"observed_at":"2026-08-07T14:44:04.124887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:03.814486Z","title":"Few-shot composition learning for image retrieval with prompt tuning","venue":null,"work_id":"b046a4fa-001b-4459-bcb8-51fe45217f18","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.426884Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:bdff1820eeaa58474fa4ba6164a30037432fcea3d275a731c38eb81356987e6f","observation_id":"09b9aa1c-3148-4543-ab08-26717d73374d","resolution":{"observed_at":"2026-08-07T14:44:03.886221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:03.556394Z","title":"Multi-modal transformer with global-local alignment for composed query image retrieval.IEEE Transactions on Multimedia, 25:8346–8357, 2023","venue":null,"work_id":"bcf01e7d-8753-4cfc-82e0-39f6efd2b88f","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.529594Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:0dcc8e0ab311486bc627ea87b98dcd0763e049d36875512b66ebeeaa56cbe305","observation_id":"0fc97d0d-4410-4529-ad8c-65a6780661de","resolution":{"observed_at":"2026-08-07T14:44:03.670750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:03.338732Z","title":"Negative-sensitive framework with semantic enhancement for composed image retrieval.IEEE Transactions on Multimedia, 26:7608–7621, 2024","venue":null,"work_id":"745079d0-4299-4896-803a-649a608f9850","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.638400Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:bd22775e14df29abb8c9eaf0837f066f536ee7e76a66d49f98f1d0d2e0472f14","observation_id":"2bbcb864-4f2c-4c57-a354-4a7717ff6e83","resolution":{"observed_at":"2026-08-07T14:44:03.405453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:03.107622Z","title":"Collaborative group: Composed image retrieval via consensus learning from noisy annotations.Know.-Based Syst., 300(C), November 2024","venue":null,"work_id":"228cb3eb-ebe5-4df5-89db-ef9daa869b26","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.712930Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:a97df7d0c3180a591da23ef09dbc047c61887a3e231a77adb77fa0aadc192105","observation_id":"47c2e41f-f78a-4195-a321-dfbdb6cae9e8","resolution":{"observed_at":"2026-08-07T14:44:03.202885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06001","last_updated":"2024-11-12T15:14:41Z","snapshot_observed_at":"2026-07-06T18:43:05.700263Z","submitted_at":"2024-07-08T14:53:07Z","title":"Pseudo-triplet Guided Few-shot Composed Image Retrieval","version":2},"cited_work":{"arxiv_id":"2407.06001","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.06001","snapshot_observed_at":"2026-08-07T14:44:00.737636Z","title":"Pseudo-triplet Guided Few-shot Composed Image Retrieval","venue":"cs.CV","work_id":"f8820334-5743-4543-b07d-ad7149dae7cc","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.819184Z"},"links":{"cited_paper":"/paper/2407.06001","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:68805895a0e92bed3cd8a55f0a9e8dd70c1a4b35ff4b18704f4d301b303b4170","observation_id":"c4d06de3-3b1b-4a24-bd20-993fff0a405b","resolution":{"observed_at":"2026-08-07T14:44:00.833866Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:02.923092Z","title":"Vqa4cir: Boosting composed image retrieval with visual question answering","venue":null,"work_id":"f2fd6ed3-64d6-4603-ba5e-61aa203fa353","year":2025},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:58.924199Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:eade5d792e5e8f71ec6ab716d6e2dc7d4730dbd081b0d746e65a69f54a1c7347","observation_id":"26a671d1-1f42-42d1-94a7-b065f3b4e3d3","resolution":{"observed_at":"2026-08-07T14:44:02.980271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21309","last_updated":"2025-03-27T09:34:21Z","snapshot_observed_at":"2026-08-07T16:33:24.726393Z","submitted_at":"2025-03-27T09:34:21Z","title":"FineCIR: Explicit Parsing of Fine-Grained Modification Semantics for Composed Image Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21309","snapshot_observed_at":"2026-08-07T14:43:59.017726Z","title":"Finecir: Explicit parsing of fine-grained modification semantics for composed image retrieval.arXiv preprint arXiv:2503.21309, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.017726Z"},"links":{"cited_paper":"/paper/2503.21309","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:74f4c7103aa7621938158d3bf9b42a32848d3cdd623e5e3c90103377cb789a6e","observation_id":"772e0a21-3533-4e85-8e31-0d4eb9e10ad9","resolution":{"observed_at":"2026-08-07T14:43:59.017726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-07T14:43:59.111384Z","title":"An image is worth one word: Personalizing text-to-image generation using textual inversion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.111384Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:d475b0e56bb062f5dcc0f89b463951496f5615e43f9f73e40bcb0fd1a02aa459","observation_id":"80a03846-8f31-4db0-a824-3356847631c0","resolution":{"observed_at":"2026-08-07T14:43:59.111384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:02.672474Z","title":"Knowledge-enhanced dual-stream zero-shot composed image retrieval","venue":null,"work_id":"6b938a87-cf5d-484e-b906-e7f5f8f6ec0e","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.192994Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:6eb0cd0ad8496fb87756e335b7da3110a1f4ac8d5e9ea734aeafe82c062ce28e","observation_id":"67f32931-9266-4381-8bc8-431c18972396","resolution":{"observed_at":"2026-08-07T14:44:02.797198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:02.374622Z","title":"Ldre: Llm-based divergent reasoning and ensemble for zero-shot composed image retrieval","venue":null,"work_id":"ec1d30c8-3716-4c5d-a81c-8404c3fa8eeb","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.280809Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:744b6f3ae52c9a59d839fb1130b11620f869a2cd51065d0cf5b8b934afb8cc27","observation_id":"5ffbfd32-a300-4691-8c1a-9c45e22790da","resolution":{"observed_at":"2026-08-07T14:44:02.506820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:02.070993Z","title":"Semantic editing increment benefits zero-shot composed image retrieval","venue":null,"work_id":"a1655c77-e8c5-405d-9bdd-d0c2eeffb202","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.371617Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:37a11e70bcc9d50f98bdbd647e877e79c6b7a1bf5f6ffbbfec400e539318fb19","observation_id":"8a56a2f1-b974-407a-ba18-6e51006b2f95","resolution":{"observed_at":"2026-08-07T14:44:02.240291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09291","last_updated":"2024-02-26T18:59:49Z","snapshot_observed_at":"2026-08-06T04:16:13.638840Z","submitted_at":"2023-10-13T17:59:38Z","title":"Vision-by-Language for Training-Free Compositional Image Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09291","snapshot_observed_at":"2026-08-07T14:43:59.484503Z","title":"Vision-by-language for training-free compositional image retrieval.arXiv preprint arXiv:2310.09291, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.484503Z"},"links":{"cited_paper":"/paper/2310.09291","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:b31683f1ea25bb4900be79660149022d1035db8695856c89daaa4ee26c7e6bcc","observation_id":"703b7aba-149f-44df-9c13-06255edc21b9","resolution":{"observed_at":"2026-08-07T14:43:59.484503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18495","last_updated":"2025-03-04T15:16:52Z","snapshot_observed_at":"2026-08-07T18:06:56.322892Z","submitted_at":"2025-02-19T01:37:24Z","title":"A Comprehensive Survey on Composed Image Retrieval","version":2},"cited_work":{"arxiv_id":"2502.18495","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.18495","snapshot_observed_at":"2026-08-07T14:44:00.508748Z","title":"A Comprehensive Survey on Composed Image Retrieval","venue":"cs.MM","work_id":"1aa65162-0351-46c7-868f-ab2fd47a0f3a","year":2025},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.614237Z"},"links":{"cited_paper":"/paper/2502.18495","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:6cfd34e6059b25f087b85be326123f11d91b439c6cce45394eaafaada1893565","observation_id":"06229b1f-0c8f-4221-aedc-b2a67d74340a","resolution":{"observed_at":"2026-08-07T14:44:00.614106Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.00145","last_updated":"2020-06-30T22:55:02Z","snapshot_observed_at":"2026-08-07T03:42:09.406820Z","submitted_at":"2020-06-30T22:55:02Z","title":"Modality-Agnostic Attention Fusion for visual search with text feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.00145","snapshot_observed_at":"2026-08-07T14:43:59.708865Z","title":"Modality-agnostic attention fusion for visual search with text feedback.arXiv preprint arXiv:2007.00145, 2020","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.708865Z"},"links":{"cited_paper":"/paper/2007.00145","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:7ab55fbae99989881a4068a3627f49dedf3f571a457d0fc3430c1666b6dacf64","observation_id":"0ac25f3e-b83d-4c79-a872-74146f2e3f59","resolution":{"observed_at":"2026-08-07T14:43:59.708865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:01.799724Z","title":"Cosmo: Content-style modulation for image retrieval with text feedback","venue":null,"work_id":"aacad22b-abd6-4299-9bce-3745de15ff2f","year":2021},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.822245Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:8205ee5507bdde267ea6947f70e7ef13a0e9e28999f5bd6ac3a83bca7582e639","observation_id":"a6d9ad5f-e31f-4fb9-bdd4-e2bb91c63319","resolution":{"observed_at":"2026-08-07T14:44:01.918365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:01.592368Z","title":"Fame-vil: Multi-tasking vision-language model for heterogeneous fashion tasks","venue":null,"work_id":"1e032c76-33d6-4ac4-9d90-44426e07ea94","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:59.927882Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:156caf6d33f9c00fd5a0861de7d563bd39ff287af85449f07f1a2c509db0b0ca","observation_id":"911ef9e2-5ed9-4ecb-8076-f625388f2885","resolution":{"observed_at":"2026-08-07T14:44:01.674657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:01.346760Z","title":"Composed image retrieval with text feedback via multi-grained uncertainty regularization","venue":null,"work_id":"5b793b78-f002-4d0f-ae7c-924c8f158f9c","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:00.032163Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:8c83acde8b7cd47093edb123836505e64edfcfd35b9acb1f5f68401658c7fd49","observation_id":"51debe43-6489-439b-bf22-41e80531f186","resolution":{"observed_at":"2026-08-07T14:44:01.439682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:01.159511Z","title":"Genecis: A benchmark for general conditional image similarity","venue":null,"work_id":"9661cf3c-c338-482a-ae37-75036d703580","year":2023},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:00.115285Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:c26c02eb3cbd575768b710c4b4be09691b2c7becd2c525cf440dc2d3a70e6309","observation_id":"9e93f219-e6a6-4c75-a46b-902f76e144c3","resolution":{"observed_at":"2026-08-07T14:44:01.261547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:44:00.981155Z","title":"Language-only training of zero-shot composed image retrieval","venue":null,"work_id":"151b1223-4676-48bf-bf5e-9f6362c7e0da","year":2024},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:00.208920Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:44a993e419ad0fcaf2bafd964ab1caacd9bccc3e2276c834ccd938a0a0e90b17","observation_id":"36cc717f-0d3d-4ff3-a4c7-10f92ad5a3d4","resolution":{"observed_at":"2026-08-07T14:44:01.056423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17109","last_updated":"2025-03-30T12:19:03Z","snapshot_observed_at":"2026-08-07T16:46:41.665183Z","submitted_at":"2025-03-21T12:49:50Z","title":"Missing Target-Relevant Information Prediction with World Model for Accurate Zero-Shot Composed Image Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17109","snapshot_observed_at":"2026-08-07T14:44:00.325185Z","title":"Missing target-relevant information prediction with world model for accurate zero-shot composed image retrieval","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:00.325185Z"},"links":{"cited_paper":"/paper/2503.17109","citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:196075dee3a8f85b5514e5e9776c3f74de377f6931566e5aa35d86d2320d8eba","observation_id":"8a3e7ba4-27b1-44f9-892f-21eba2dee7eb","resolution":{"observed_at":"2026-08-07T14:44:00.325185Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:56.707152Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:56.707152Z"},"links":{"citing_paper":"/paper/2505.17796"},"observation_digest":"sha256:e77f1037212e204bda2aeb913d8ee4945fd0de3fbbf80d98fe5eff4f91a963dd","observation_id":"f154ed0a-03cc-4ea0-838d-357fdb610286","resolution":{"observed_at":"2026-08-07T14:43:56.707152Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17796","last_updated":"2025-05-23T12:15:23Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T14:38:21.638255Z","submitted_at":"2025-05-23T12:15:23Z","title":"DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":18,"verified_exact":2,"verified_fuzzy":43},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 4 inbound Pith citation observations for arXiv:2505.17796."}