{"as_of":"2026-08-07T09:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf0c63bf2913f65ff26bc05fa5f35572ada63f44d933ada535ce62a88e581324","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:45:22.837049Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.12823/citation-record","integrity":"/paper/2507.12823/integrity","json":"/paper/2507.12823/citation-record.json","paper":"/paper/2507.12823"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:29.035742Z","title":"Composing text and image for image retrieval-an empirical odyssey,","venue":null,"work_id":"3b53e70c-f92f-4a1f-b2fa-83d0a365d533","year":2019},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.078201Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:f0485968ac2b11475bde1716e7603857144456161b1954ca6882377c07357610","observation_id":"567e66fd-3477-4ffd-a70b-e2834a643f10","resolution":{"observed_at":"2026-08-06T16:45:29.111850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:28.924997Z","title":"Content-based retrieval of segmented images,","venue":null,"work_id":"64b21d98-2df9-492c-81ac-c99aaea11cd9","year":1994},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.152638Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:07679e4d163dbee8c293a37583a5fe375ca138c33ea6ac91b1f76c1fbfc4c28e","observation_id":"feb0ed33-9bcf-4cf8-83a1-873be3dd7498","resolution":{"observed_at":"2026-08-06T16:45:28.977404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:28.762819Z","title":"Context-aware multi- view summarization network for image-text matching,","venue":null,"work_id":"50853f19-d62d-4254-8653-a02c6fa2bbff","year":2020},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.237022Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:2df4ea3523e382ff6bc5f911a1baa23d5069c19a176e85137fe933f4b58d14bc","observation_id":"859ec10a-25f5-4cb2-bf9c-c91282f9c222","resolution":{"observed_at":"2026-08-06T16:45:28.825809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:20.315902Z","title":"Empowering things with intelligence: a survey of the progress, challenges, and opportunities in artificial intelligence of things,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.315902Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:946d67542bad4d15aca586774254661c26bbf33383ed98a2ea50593551a09162","observation_id":"492ef7f4-217a-4358-a37e-668244a91028","resolution":{"observed_at":"2026-08-06T16:45:20.315902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:28.636741Z","title":"Data roaming and quality assessment for composed image retrieval,","venue":null,"work_id":"38bac547-60bf-4908-a01b-a0732fea1803","year":2024},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.390323Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:eee32f705fd4f466664a22f5b566c27a744da43da4e3872d14caa5a68a56eae7","observation_id":"86d06452-37cc-4e6d-a3b3-28c3ae293c36","resolution":{"observed_at":"2026-08-06T16:45:28.690608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:20.462797Z","title":"CompoDiff: Versatile composed image retrieval with latent diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.462797Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:4a64309d0ac5658d3290366db8f669eaaef1ff1372a9b4bc20e0f3ff6f16f645","observation_id":"a80d5ea0-975b-4f63-9bff-41cae96fc167","resolution":{"observed_at":"2026-08-06T16:45:20.462797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:28.459156Z","title":"Comprehensive linguistic-visual composition network for image retrieval,","venue":null,"work_id":"92cbc9ac-c0d9-475f-9521-8857384d5d64","year":2021},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.552072Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:77bc9f130ba2474b5dc7752141c68eb60b31ad5868cbf76cfc6f7ffd99173761","observation_id":"c75adc9a-e5aa-45af-855b-438b59cc222d","resolution":{"observed_at":"2026-08-06T16:45:28.553829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:28.331438Z","title":"Simple but effective raw-data level multimodal fusion for composed image retrieval,","venue":null,"work_id":"9032d1f9-2e93-40de-a127-cbfac4931fba","year":2024},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.609587Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:d9cd5c4bd1fcb7df1333fa8cf0826d50abfb309086de2f9bde2a81af3447226d","observation_id":"147e2012-2ba3-428b-a980-bb0addbda639","resolution":{"observed_at":"2026-08-06T16:45:28.382364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:28.169030Z","title":"Information captur- ing camera and developmental issues,","venue":null,"work_id":"31c819da-39e8-4eda-83dc-7b1668444cf8","year":1999},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.670360Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:1f67d9c20c4121bb48f1707ba7e0898496f56c76f6d2c6a2236335183bd42daf","observation_id":"7a1992c1-4088-439d-8df5-8834ee41e2a9","resolution":{"observed_at":"2026-08-06T16:45:28.242534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:27.971366Z","title":"Sentence-level prompts benefit composed image re- trieval,","venue":null,"work_id":"5a3a5dde-df62-4697-9729-727107902e4e","year":2024},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.740132Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:88a22056e03ed0fa9cf21961a4c17521979dd80662331864ec4a9f50128f8b7b","observation_id":"ef53b9cd-b054-4932-bbc5-dc69719f589e","resolution":{"observed_at":"2026-08-06T16:45:28.091707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:27.692382Z","title":"Dynamic weighted combiner for mixed-modal image retrieval,","venue":null,"work_id":"6b83fa60-4b5a-43c1-b6d6-efda78aa64e2","year":2024},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.800065Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:d60d3e252e1b831f439b34cc6973e5479b1c4ad53e6f06a173478efd9556fefb","observation_id":"8faa2a3a-ee7d-4159-99f2-ee6236382ac8","resolution":{"observed_at":"2026-08-06T16:45:27.812537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:27.481764Z","title":"MMFT- BERT: Multimodal fusion transformer with bert encodings for visual question answering,","venue":null,"work_id":"b0a703f1-6ef0-49aa-a0ac-4af2d835ba01","year":2020},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.870478Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:20c672125d27bb9f781ccda204b9edefe1b10a15d86d5a4fbcd4eb5f5bb914ca","observation_id":"4e165ee2-004c-4000-a5e5-5383b8471d73","resolution":{"observed_at":"2026-08-06T16:45:27.551674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:27.195927Z","title":"Multimodal inverse cloze task for knowledge-based visual question answering,","venue":null,"work_id":"a45c58fb-95e7-4e9d-ad2f-af3cdd847620","year":2023},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.923925Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:cd15672465f06a19e07bd88f05af9a18c61e9a908ab9d9c5b36b3628a2740272","observation_id":"fb82e80b-e009-40a7-9dc8-552645c806fe","resolution":{"observed_at":"2026-08-06T16:45:27.310776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:26.941784Z","title":"Motion influence map for unusual human activity detection and localization in crowded scenes,","venue":null,"work_id":"6b2e18fe-8913-4c12-bbba-b08b87be7dd0","year":2015},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:20.993284Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:4009920eabf2e0199e7ec9700aeaaad9fc357d1ea7313da02b6f53a4a5a9ece8","observation_id":"e01ef22a-c611-4614-97e8-031a3633abe6","resolution":{"observed_at":"2026-08-06T16:45:27.032380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:26.698185Z","title":"A new recurrent neural-network archi- tecture for visual pattern recognition,","venue":null,"work_id":"9d4af05b-387b-4008-8838-3a0e7bf01073","year":1997},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:21.059669Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:dec1d4110f4ce2b2c4982c8c832fbf57ccb690979ba4654d5771911e8d474cc2","observation_id":"2410759f-5ee7-48fd-8cb5-adad3719f8e0","resolution":{"observed_at":"2026-08-06T16:45:26.816696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:26.412197Z","title":"BLIP-2: Bootstrapping language- image pre-training with frozen image encoders and large language models,","venue":null,"work_id":"abffecad-208e-4929-a253-78c905fa6740","year":2023},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:21.160609Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:c8e228f80a2fe8945aaec235959e61163512fb88eb31a34b8d7c4f9cad78ecd3","observation_id":"98676264-81ea-400b-9d18-20408f249cda","resolution":{"observed_at":"2026-08-06T16:45:26.559656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:26.163186Z","title":"FashionIQ: A new dataset towards retrieving images by natural language feedback,","venue":null,"work_id":"96a2c46c-d439-4226-a2ac-f0c9ed7d54df","year":2021},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:21.226174Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:3cdedc9aae7a00973df15dfbeca6c377128ad00136652298b2d617e4063fa2af","observation_id":"9c1bd8d8-b136-440c-95d2-d3e519366dd0","resolution":{"observed_at":"2026-08-06T16:45:26.294751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:21.291392Z","title":"Image retrieval on real-life images with pre-trained vision-and-language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:21.291392Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:a06ccdf1dc8bcdf6e71becf9a573736f22abd0c0bd0bd4414246d5c7cae49806","observation_id":"afcd6c33-0bf9-4e56-b885-148a01391fe9","resolution":{"observed_at":"2026-08-06T16:45:21.291392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:21.354297Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:21.354297Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:d090670c36464c6b6d7503f7c0c58769f8b51434140e84a7479e1feb71c46e27","observation_id":"fcec8a2b-dde7-48e4-ba53-1d9bc524b210","resolution":{"observed_at":"2026-08-06T16:45:21.354297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:25.826558Z","title":"FashionVLP: Vision language transformer for fashion retrieval with feedback,","venue":null,"work_id":"ebd23d60-37e9-4c2f-aaec-72cc40313f03","year":2022},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:21.408611Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:9dbb70ab0d86c423f625ea3c360289b4dfcb85ab09e1028b1ab8801116dc3959","observation_id":"a577aff9-ca12-4039-901d-ada3be592d97","resolution":{"observed_at":"2026-08-06T16:45:25.992669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:25.562570Z","title":"COSMO: Content-style modulation for image retrieval with text feedback,","venue":null,"work_id":"aa12567a-a224-4522-98c6-c6fdfc20449a","year":2021},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:21.456724Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:f8fff9e5621cc2a3fbb37dc8558a161e631a8e3839428faa7df8046a361119f4","observation_id":"a48adf09-ec80-478b-b351-422e3ad29141","resolution":{"observed_at":"2026-08-06T16:45:25.633491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:25.277784Z","title":"PAIR: Complementarity-guided disentanglement for composed image retrieval,","venue":null,"work_id":"58f3d7c2-12b2-4e2d-bba4-843465367216","year":2025},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:21.509208Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:7a7e880f2b8785668038b8dd791da94a190b1e708d291f8d94835ba4ee206922","observation_id":"dd300395-70ba-4f1c-82d5-ef14ae31f413","resolution":{"observed_at":"2026-08-06T16:45:25.445822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:25.030756Z","title":"Target-guided composed image retrieval,","venue":null,"work_id":"fa249682-78a1-4493-9baa-5dc18a1b7163","year":2023},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:21.606684Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:0812d7bc43f4d3bfea9951dc1dca2d6735481c85300c088a5fb61411f9ba1ed2","observation_id":"2048528d-0587-46d6-87a6-33a566770706","resolution":{"observed_at":"2026-08-06T16:45:25.136377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:24.822183Z","title":"Syncmask: Synchronized attentional masking for fashion-centric vision-language pretraining,","venue":null,"work_id":"21498878-533c-4617-a082-c7ddd59efbe3","year":2024},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:21.700112Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:595745e4f38cf9f7b989392c007b475122b84aa13a21071cb8d17c6402606671","observation_id":"cff7342c-29fc-4cf7-88bc-2fea7fbabc4d","resolution":{"observed_at":"2026-08-06T16:45:24.900178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:24.562701Z","title":"MEDIAN: Adaptive intermediate-grained aggrega- tion network for composed image retrieval,","venue":null,"work_id":"8c0f0c00-5675-49b1-86d4-3b73361b8cc8","year":2025},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:21.816228Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:48e4b83484e762ddfc7df9730a4979d560554597fb4a4daf092a1ee07ba5ff4d","observation_id":"6d84656f-85b5-4d20-986e-238bfaae73ab","resolution":{"observed_at":"2026-08-06T16:45:24.709111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:24.312506Z","title":"Composed image retrieval with text feedback via multi-grained uncertainty regulariza- tion,","venue":null,"work_id":"edb69bf0-9cd9-4fa0-b281-9f1f9ce873c4","year":2024},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:21.952752Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:48734177f55d8bd6286bc0fa15751ef4fb5d8c8275ca22265c78cb36d428e8f7","observation_id":"99931e5e-62bd-424f-a91c-b804dd2cb2bb","resolution":{"observed_at":"2026-08-06T16:45:24.417021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:24.065037Z","title":"Decomposing semantic shifts for composed image retrieval,","venue":null,"work_id":"32f2952e-7f8c-47cc-bfbf-1fbe1ff99ad1","year":2024},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:22.108890Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:468821a5e2bd1aeafb4f4d99c8adc9bd37c0e5fe4d0977f04e45a4a92b9897d0","observation_id":"b673e4d5-3fab-4476-9216-48f7e9672c6d","resolution":{"observed_at":"2026-08-06T16:45:24.172058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:23.817714Z","title":"CLIP4Clip: An empirical study of CLIP for end to end video clip retrieval and captioning,","venue":null,"work_id":"150a2a3a-e4f4-462e-874b-d657ad29a471","year":2022},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:22.211888Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:7b3f39d3e746bcd02981e21f68eed26226e2a374c4088738edb01e84e448d67d","observation_id":"3dc939cc-4b5a-406f-a019-08896f1fc71c","resolution":{"observed_at":"2026-08-06T16:45:23.960802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.08101","last_updated":"2022-05-16T15:20:04Z","snapshot_observed_at":"2026-08-07T02:31:05.614504Z","submitted_at":"2022-03-15T17:29:20Z","title":"ARTEMIS: Attention-based Retrieval with Text-Explicit Matching and Implicit Similarity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.08101","snapshot_observed_at":"2026-08-06T16:45:22.321678Z","title":"ARTEMIS: Attention-based retrieval with text-explicit matching and implicit sim- ilarity,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:22.321678Z"},"links":{"cited_paper":"/paper/2203.08101","citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:7df3d7163ec2e232e35c4dc594341f58dc9e54f1c368ff8cd905f8480c235e7f","observation_id":"1034b536-3429-4fc9-92b6-27b238786d61","resolution":{"observed_at":"2026-08-06T16:45:22.321678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:23.519551Z","title":"An image is worth 16x16 words: transformers for image recognition at scale,","venue":null,"work_id":"d12ff4e6-8c5a-4545-9fab-475c6e9ce52c","year":2020},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:22.402266Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:87c267d3693ce364fef50990de3446395a3c46b0089032a0478ec3c4353e5a4d","observation_id":"5e82d5b6-7681-4b1c-9ec2-0a9e67500065","resolution":{"observed_at":"2026-08-06T16:45:23.668007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:23.335537Z","title":"Integrated segmentation and recognition of handwritten numerals with cascade neural network,","venue":null,"work_id":"d08dc2e9-7469-4ba7-80c2-e5f4215d3ad0","year":1999},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:22.526198Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:b6f12b9a8e90ec1ed312eed205057502a8d83d52e57bad2c556b3f952a439587","observation_id":"0a616171-620f-422b-9393-77fd97e6771a","resolution":{"observed_at":"2026-08-06T16:45:23.433598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:22.650222Z","title":"Accurate object contour tracking based on boundary edge selection,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:22.650222Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:7bff0c1d598836b0d720e866c01fee27946a1d804a5620656e71e490be90d10f","observation_id":"33c9c69d-7ac0-49b4-b61a-58c1bbcae949","resolution":{"observed_at":"2026-08-06T16:45:22.650222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:23.014181Z","title":"BERT: Pre- training of deep bidirectional transformers for language understand- ing,","venue":null,"work_id":"da738e0c-9384-48e6-a47d-6b06dd84f824","year":2019},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:22.744887Z"},"links":{"citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:1e5f1af1fa771ac2ddc5e88e557be9593d90db4b7ad49dc71de567c6b81b75b7","observation_id":"c4c4a7a4-45fc-4972-a77a-b0347a54b0ac","resolution":{"observed_at":"2026-08-06T16:45:23.188701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T16:45:22.837049Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:45:22.837049Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.12823"},"observation_digest":"sha256:53c4d13adb6653c9e14e3f73544b0131f79f1579c091c1b73681cd81509bc8c7","observation_id":"93d642e4-4e60-49f9-9df2-e47958d928b3","resolution":{"observed_at":"2026-08-06T16:45:22.837049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.12823","last_updated":"2025-07-17T06:30:41Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T16:35:31.626335Z","submitted_at":"2025-07-17T06:30:41Z","title":"FAR-Net: Multi-Stage Fusion Network with Enhanced Semantic Alignment and Adaptive Reconciliation for Composed Image Retrieval"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2507.12823."}