{"as_of":"2026-08-08T10:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9244a65e2c0d15dddfb36aba64b13f68188a60838d968455de298e0909c4498c","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:42:41.589550Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.12819/citation-record","integrity":"/paper/2507.12819/integrity","json":"/paper/2507.12819/citation-record.json","paper":"/paper/2507.12819"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.710706Z","title":"Composing text and image for image retrieval-an empirical odyssey,","venue":null,"work_id":"990d186b-e4f1-4a7e-92f2-064367294ab8","year":2019},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:39.296044Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:4bee1eef5d7f3dd3430e433520b832d7b1780978b545d5bbe55cb3553792f25d","observation_id":"81f8f49a-04f6-4809-9cb8-970f61663e0c","resolution":{"observed_at":"2026-08-06T16:42:42.720576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.675463Z","title":"Empowering things with intelligence: a survey of the progress, challenges, and opportunities in artificial intelligence of things,","venue":null,"work_id":"ca656c24-eb2d-4b4f-868a-a7d58f7a3b1b","year":2020},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:39.385770Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:b6cae449b09fea5b222bb903cc0c95f9ee1d61c84768d13554413aa13ba205ab","observation_id":"4832dcfc-95ea-495b-855c-17d9f453621b","resolution":{"observed_at":"2026-08-06T16:42:42.685272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.641268Z","title":"Comprehensive linguistic-visual composition network for image retrieval,","venue":null,"work_id":"1f1b669f-a81b-4576-89e8-89755f888e53","year":2021},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:39.534395Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:ab251b9a69ec79746e4e320ed908650edae38a4e69943405df908697e8974c24","observation_id":"30e1723e-ef9d-4d0c-bc1c-dd1b2926997f","resolution":{"observed_at":"2026-08-06T16:42:42.650430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.619913Z","title":"Pic2Word: mapping pictures to words for zero-shot composed image retrieval,","venue":null,"work_id":"f727c6eb-dc00-46a5-80b1-8844036e0f35","year":2023},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:39.685912Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:ada45ad8c1420affd9b8d2caccdb03efe35d28373edae58072fdcd3ba0ed6b2c","observation_id":"b2ba50e7-45c0-4617-8c03-34eb87fd83f7","resolution":{"observed_at":"2026-08-06T16:42:42.626490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.595608Z","title":"Zero-shot composed image retrieval with textual inversion,","venue":null,"work_id":"7c40b5c6-6a2d-4501-8601-8ff64f63ade7","year":2023},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:39.858262Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:bbf698a3a58c06211ffc1cd6d0f31adc81b69427dd761cce345d2e81a9f0033f","observation_id":"b6e24ca7-368d-4b57-92ea-9b3a1b36a79b","resolution":{"observed_at":"2026-08-06T16:42:42.604204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.564190Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"19fd10fb-af67-421a-b07f-75b3d407d8fc","year":2021},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.038366Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:64e1f692daf3c6d8b5de1f233d4815a6add6452f34809020b9cf836eafafe198","observation_id":"3b84fd4e-3807-48a2-8b34-830cf3601919","resolution":{"observed_at":"2026-08-06T16:42:42.573699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09291","last_updated":"2024-02-26T18:59:49Z","snapshot_observed_at":"2026-08-06T04:16:13.638840Z","submitted_at":"2023-10-13T17:59:38Z","title":"Vision-by-Language for Training-Free Compositional Image Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09291","snapshot_observed_at":"2026-08-06T16:42:40.156102Z","title":"Vision-by- language for training-free compositional image retrieval,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.156102Z"},"links":{"cited_paper":"/paper/2310.09291","citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:371065dad1c581be16289ce0b5a0074d83c898cf975ee76af28de1bc8a74d259","observation_id":"b8ea230b-1b02-4063-89f3-427c1cb390ea","resolution":{"observed_at":"2026-08-06T16:42:40.156102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04918","last_updated":"2024-11-07T06:58:04Z","snapshot_observed_at":"2026-07-06T19:12:02.473662Z","submitted_at":"2024-09-07T21:52:58Z","title":"Training-free Zero-shot Composed Image Retrieval via Weighted Modality Fusion and Similarity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04918","snapshot_observed_at":"2026-08-06T16:42:40.294719Z","title":"Training-free zero-shot com- posed image retrieval via weighted modality fusion and similarity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.294719Z"},"links":{"cited_paper":"/paper/2409.04918","citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:b043ed79d215c522a5e9e977591e78ddf178f9ee1286ea1b810d41a2cf594a2b","observation_id":"f2677aa7-1298-4c39-b0e3-a1514ec44397","resolution":{"observed_at":"2026-08-06T16:42:40.294719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16752","last_updated":"2024-12-02T04:12:35Z","snapshot_observed_at":"2026-07-06T19:56:48.086175Z","submitted_at":"2024-11-24T05:27:21Z","title":"Imagine and Seek: Improving Composed Image Retrieval with an Imagined Proxy","version":2},"cited_work":{"arxiv_id":"2411.16752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16752","snapshot_observed_at":"2026-08-06T16:42:41.834214Z","title":"Imagine and Seek: Improving Composed Image Retrieval with an Imagined Proxy","venue":"cs.CV","work_id":"838c0f33-a868-464d-9047-9a06c4295b64","year":2024},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.451287Z"},"links":{"cited_paper":"/paper/2411.16752","citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:8ea63d3119fffee319c84231af1258993c6f43935be3da04580e14a6be23c3e9","observation_id":"b6876391-5553-4c3c-8555-dc856e0fe008","resolution":{"observed_at":"2026-08-06T16:42:41.886936Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.524872Z","title":"MLLM-I2W: Harnessing multimodal large language model for zero-shot composed image retrieval,","venue":null,"work_id":"f79a0409-48db-4837-8f79-1d8d096a0953","year":2025},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.523118Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:0c8d530efe2a9c957a356a9e4ca2f5910ad23d2b76094b92008e6bfa9df2d6d9","observation_id":"75600d3d-57e3-46dc-a89d-768bd572b139","resolution":{"observed_at":"2026-08-06T16:42:42.537891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.488502Z","title":"LDRE: LLM- based divergent reasoning and ensemble for zero-shot composed image retrieval,","venue":null,"work_id":"4f424531-ed6f-4607-9276-c3dd6fb05f0f","year":2024},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.589774Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:2650979509f07f5e31dc16599619b7377d4efcc6a5c92f06f687780464806162","observation_id":"dde1f7b1-60ee-48c6-9e1b-1438bb608df1","resolution":{"observed_at":"2026-08-06T16:42:42.507434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20826","last_updated":"2025-02-28T08:12:23Z","snapshot_observed_at":"2026-08-07T17:40:34.228094Z","submitted_at":"2025-02-28T08:12:23Z","title":"CoTMR: Chain-of-Thought Multi-Scale Reasoning for Training-Free Zero-Shot Composed Image Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20826","snapshot_observed_at":"2026-08-06T16:42:40.679643Z","title":"CoTMR: chain-of-thought multi-scale reasoning for training-free zero-shot composed image retrieval,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.679643Z"},"links":{"cited_paper":"/paper/2502.20826","citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:d0ddd07cc4d20dcecf978a10269d753d4176d14320e5915d7413d7fccdeb0fd4","observation_id":"a50fa821-9c3a-4479-a908-28068670d6ca","resolution":{"observed_at":"2026-08-06T16:42:40.679643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11077","last_updated":"2024-12-20T03:42:24Z","snapshot_observed_at":"2026-07-06T20:07:14.913902Z","submitted_at":"2024-12-15T06:22:20Z","title":"Reason-before-Retrieve: One-Stage Reflective Chain-of-Thoughts for Training-Free Zero-Shot Composed Image Retrieval","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11077","snapshot_observed_at":"2026-08-06T16:42:40.759011Z","title":"Reason-before-retrieve: One-stage reflective chain-of- thoughts for training-free zero-shot composed image retrieval,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.759011Z"},"links":{"cited_paper":"/paper/2412.11077","citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:f9c9258b57a3b95cab83a0493d0eb0b2ea400c06cfd6e6baeb1dce038862a43e","observation_id":"ccd282ff-b2e9-4ffa-af29-1d0d3ab50885","resolution":{"observed_at":"2026-08-06T16:42:40.759011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.433923Z","title":"FashionIQ: A new dataset towards retrieving images by natural language feedback,","venue":null,"work_id":"9daa8bd8-21a2-4bfe-9cfa-dba7296bde3a","year":2021},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.840712Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:a6969c273bf935ed5292be495be9101257f4e9c5d8e99244bd1dcaf151de76ee","observation_id":"19120313-263d-4f96-9a8d-f985e431bf38","resolution":{"observed_at":"2026-08-06T16:42:42.453556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.393386Z","title":"Image retrieval on real-life images with pre-trained vision-and-language models,","venue":null,"work_id":"e4a5605b-912b-4879-b224-b71e3e0e0d10","year":2021},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:40.924751Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:eb20ef6cc9fd7ca5e69a5f9267b453f4d139231a8c414e1ed526ca37c145d06b","observation_id":"46acbf82-91e7-4f01-a94c-942f8124413c","resolution":{"observed_at":"2026-08-06T16:42:42.402494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.355210Z","title":"CompoDiff: Versatile composed image retrieval with latent diffusion,","venue":null,"work_id":"c5d8a569-cc9c-4091-8811-b3f22ced4a38","year":2024},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.011415Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:c1417ad60969ffcfc868b296b32083f9e2f4951567b995024261f09ebbff45cf","observation_id":"af994da3-3793-42f0-967c-79767955948b","resolution":{"observed_at":"2026-08-06T16:42:42.366372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.334461Z","title":"Language-only training of zero-shot composed image retrieval,","venue":null,"work_id":"4438ea0c-277c-44bc-bff4-d0cbb69fef34","year":2024},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.069431Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:7061cfe9a2b40cb7340b009f0926fc6460aa536978d4e6e567f9260b530f0103","observation_id":"f0876b80-814f-4d2e-ae37-b930f349dd71","resolution":{"observed_at":"2026-08-06T16:42:42.340048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.308332Z","title":"Uncertainty-aware mesh decoder for high fidelity 3d face reconstruction,","venue":null,"work_id":"837475aa-3da9-452e-aa90-00157ff68b1a","year":2020},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.144511Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:2641e3c3c56e404b47326cebc8d207fe95fae42c48147f83c634e08dcfb51082","observation_id":"2426016c-dbeb-450a-8f37-92e0f5efe328","resolution":{"observed_at":"2026-08-06T16:42:42.316113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.274743Z","title":"Automatic video parsing using shot boundary detection and camera operation analysis,","venue":null,"work_id":"41420ef0-27e7-49f4-9d81-12da092b6cd6","year":2001},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.216974Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:02d3d7c7f4c30ceafacf479879f5f1577a73ee1c30637020559775dadbf2a2c4","observation_id":"63c499ca-cd52-412f-ba88-864883870e97","resolution":{"observed_at":"2026-08-06T16:42:42.287161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:41.306674Z","title":"Multilayer cluster neural network for totally unconstrained handwritten numeral recognition,","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.306674Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:815fa8b997d2f981bf8c74921cdec064fd6e2a7352d45ad4c3b17d845c80e4e9","observation_id":"6c4e1d60-798d-4f73-8bcc-c02772985bca","resolution":{"observed_at":"2026-08-06T16:42:41.306674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.210874Z","title":"Information captur- ing camera and developmental issues,","venue":null,"work_id":"5ae7bf66-35e1-4816-bfb6-82191654133a","year":1999},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.405813Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:d33eaac8825b346607817feacd6f468080a05d3737755171871513ef3f58c704","observation_id":"1de288a4-7267-4e57-b0cf-593acb385301","resolution":{"observed_at":"2026-08-06T16:42:42.224281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T16:42:41.513713Z","title":"Gemini: a family of highly capable multimodal models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.513713Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:455b9b4c338ff8385b9e00cce01852d2d76e478dc10a00998b5829189728381c","observation_id":"cef5f7c5-0d66-4539-abc6-1442534e1663","resolution":{"observed_at":"2026-08-06T16:42:41.513713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:42:42.096390Z","title":"Multiresolution recog- nition of unconstrained handwritten numerals with wavelet transform and multilayer cluster neural network,","venue":null,"work_id":"785bc176-9240-460a-9b6c-4f83e6ef5572","year":1953},"citing_paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:41.589550Z"},"links":{"citing_paper":"/paper/2507.12819"},"observation_digest":"sha256:cb94ed5b33700417cc57cda0c685dc48253c5e04cb59335a537312b0104a9d9b","observation_id":"ee92c5c1-ac7b-4ecc-945b-7999fe75fe63","resolution":{"observed_at":"2026-08-06T16:42:42.157972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12819","last_updated":"2025-07-17T06:22:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T16:35:39.354779Z","submitted_at":"2025-07-17T06:22:49Z","title":"MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2507.12819."}