{"as_of":"2026-08-09T16:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:134782836250f8e078f71732ed0114edfb46df50364f34777243e41f93d61b7e","coverage":[{"denominator":254,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:20:06.663207Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:24:14.492816Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T15:27:13.506762Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.22791","snapshot_observed_at":"2026-08-05T16:24:14.492816Z","title":"Modality- aware feature matching: A comprehensive review of single-and cross- modality techniques,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18630","last_updated":"2025-08-26T03:13:08Z","snapshot_observed_at":"2026-08-09T03:11:23.534752Z","submitted_at":"2025-08-26T03:13:08Z","title":"Uncertainty Awareness on Unsupervised Domain Adaptation for Time Series Data","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T16:24:14.492816Z"},"links":{"cited_paper":"/paper/2507.22791","citing_paper":"/paper/2508.18630"},"observation_digest":"sha256:b200dde7266254f17fd4a763ba8143d3362ea3d2eee5846627591bcfd0cfb10d","observation_id":"7ab5a4ac-60ef-41a3-8584-ac4980a5a44e","resolution":{"observed_at":"2026-08-05T16:24:14.492816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2507.22791","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.22791","snapshot_observed_at":"2026-08-05T15:27:13.506762Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","venue":"cs.CV","work_id":"8ea20a6f-ff3a-43a8-9aa7-e52c6eddd2ad","year":2025},"citing_paper":{"arxiv_id":"2508.19909","last_updated":"2025-08-27T14:13:01Z","snapshot_observed_at":"2026-08-06T11:58:51.628386Z","submitted_at":"2025-08-27T14:13:01Z","title":"Integrating SAM Supervision for 3D Weakly Supervised Point Cloud Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T15:27:12.792903Z"},"links":{"cited_paper":"/paper/2507.22791","citing_paper":"/paper/2508.19909"},"observation_digest":"sha256:4aaab15fd0dd3b0870e589bf55087dfbe6dc1b0b890d87267b0351066bec2fc2","observation_id":"d239c368-65bb-43a2-b7bb-6d2d4435be93","resolution":{"observed_at":"2026-08-05T15:27:13.511210Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.22791/citation-record","integrity":"/paper/2507.22791/integrity","json":"/paper/2507.22791/citation-record.json","paper":"/paper/2507.22791"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:02.376945Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:02.376945Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:8d605f99edfe6f0fad2b783e682063898de01309623fc3db70f05cf8d5ae27b4","observation_id":"edd8fd34-92ba-432d-b823-d0af2b1c0e5a","resolution":{"observed_at":"2026-08-06T11:20:02.376945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21538","last_updated":"2025-06-26T17:55:34Z","snapshot_observed_at":"2026-08-09T03:11:18.725435Z","submitted_at":"2025-06-26T17:55:34Z","title":"Maximal Matching Matters: Preventing Representation Collapse for Robust Cross-Modal Retrieval","version":1},"cited_work":{"arxiv_id":"2506.21538","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21538","snapshot_observed_at":"2026-08-06T11:20:07.565128Z","title":"Maximal Matching Matters: Preventing Representation Collapse for Robust Cross-Modal Retrieval","venue":"cs.CV","work_id":"bf44e282-29be-4a12-9ff4-f9049c353209","year":2025},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:02.477170Z"},"links":{"cited_paper":"/paper/2506.21538","citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:c1d7f31c14e76bb333187153c20a8a27146e892313110dc9facfd9b18dac4522","observation_id":"a7d480ae-0008-4b42-bef6-805184536694","resolution":{"observed_at":"2026-08-06T11:20:07.568676Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:02.566973Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:02.566973Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:cedb0d5b7fa24261c78294a725cb2c4998b3fddcf5fc9263e1cd2931ea409029","observation_id":"cdad037c-7152-4e44-bb42-44d955bb61a7","resolution":{"observed_at":"2026-08-06T11:20:02.566973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:02.644517Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:02.644517Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:d3387a278f3aa2192bd0b751f416cb979fd578a3abb79499a8ea17706bfdf453","observation_id":"ec06c622-f323-43ca-ab23-3c3d93e0528d","resolution":{"observed_at":"2026-08-06T11:20:02.644517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:02.718107Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:02.718107Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:49a6cce8e6a55fc19fdbd6f9446d74ec4adaeab839a32d7d9fbd3fd2e0002d9e","observation_id":"5fe73407-edb9-4860-bc8b-5eb74bfedf39","resolution":{"observed_at":"2026-08-06T11:20:02.718107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:02.807720Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:02.807720Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:359740124457065d1fd9c6fdfdcc679a68f717fce08b99f698a24c57506ec9b2","observation_id":"be467d7e-7815-4a92-9403-72b8fd4bddab","resolution":{"observed_at":"2026-08-06T11:20:02.807720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:02.914951Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:02.914951Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:9b9476b59f0e26eef94efd2faba578a9ea64c0bbbcae21d6741cac84135a18b1","observation_id":"555b5538-9f8d-4a9d-ad45-9287a0212138","resolution":{"observed_at":"2026-08-06T11:20:02.914951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.05783","last_updated":"2020-10-17T23:58:06Z","snapshot_observed_at":"2026-07-06T08:43:58.019943Z","submitted_at":"2019-12-12T05:56:53Z","title":"CLOSURE: Assessing Systematic Generalization of CLEVR Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.05783","snapshot_observed_at":"2026-08-06T11:20:03.096414Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:03.096414Z"},"links":{"cited_paper":"/paper/1912.05783","citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:99ee5822d322399b54e0037086e1b6ef6582b5d8a0e809b881c471baaa3e8e49","observation_id":"9088e303-e19b-4a31-a009-ddf6c63bdb9c","resolution":{"observed_at":"2026-08-06T11:20:03.096414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:03.201303Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:03.201303Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:bc4679db8854f504a7e9f3b122e334c5eb495371445644b47c558c0f1c1fc2b6","observation_id":"9b5193c1-f2fa-4cda-8dcd-9b6c54241d94","resolution":{"observed_at":"2026-08-06T11:20:03.201303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:03.280467Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:03.280467Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:f89e83a592408d977a91d564d94424bedb87a428ea77a1029dc516aa49b080fa","observation_id":"5e169500-1d33-4724-90ab-a4042a365267","resolution":{"observed_at":"2026-08-06T11:20:03.280467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:03.361922Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:03.361922Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:96a68a249f28a37cab7d70c18aa368ae61d17dceb34e43fdfa59f9b91a6ba125","observation_id":"4d37d346-f84e-4220-b2ed-0b0678452404","resolution":{"observed_at":"2026-08-06T11:20:03.361922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:03.441351Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:03.441351Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:399d430b56319eb4ac1d5c9ea93679e300165dc6421860dff013af02cbc18f2e","observation_id":"763ab24d-cf3c-47a3-854a-165dbffbc629","resolution":{"observed_at":"2026-08-06T11:20:03.441351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:03.611884Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:03.611884Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:78d5222352a7057b0293f3791437ab41824040fd67b852c35ce6495b6b173dd0","observation_id":"2b372af8-311e-4f40-9ad5-2925e2bfa371","resolution":{"observed_at":"2026-08-06T11:20:03.611884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:03.740923Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:03.740923Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:797b16413842c1c98069d84d0e5ae2ae0e4ec7bea7c94eb77727370fd9e27349","observation_id":"0088f5ae-49e1-46f7-ae21-67635d114a2e","resolution":{"observed_at":"2026-08-06T11:20:03.740923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:03.814666Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:03.814666Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:aabeb19395958ffe5c1e383fb05b0f963dd0a1c35ab8937ce72cf91af53f5f4c","observation_id":"f94d7b70-8358-4422-8b6b-297f431d756f","resolution":{"observed_at":"2026-08-06T11:20:03.814666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:03.890543Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:03.890543Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:69c11b0d1cddfa15dde2512e8c425a9307b486d54db4950d52fccfb37ee506de","observation_id":"e3de226d-a5b9-49a3-944c-a1d252ca5bc6","resolution":{"observed_at":"2026-08-06T11:20:03.890543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:03.957796Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:03.957796Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:c07d8121a424859abe9276572317051d1e150aec49f328f1827acb563eeb8c35","observation_id":"cb21731a-c7a8-42bb-94dd-a99dfe9d1ae2","resolution":{"observed_at":"2026-08-06T11:20:03.957796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:04.067007Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:04.067007Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:cc95dcc48481bbc7e75009cd4b689737a2116474c02b01e3160d80be3e59f500","observation_id":"b1997f6a-402a-4ef0-9da7-a0b27aa323b3","resolution":{"observed_at":"2026-08-06T11:20:04.067007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:04.225798Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:04.225798Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:93f35096dcf310ac94d94e15db42a70a093147b85c676f9f266545db97ce1e88","observation_id":"b6e19496-0ac3-4087-8a11-d0b028ca3f9f","resolution":{"observed_at":"2026-08-06T11:20:04.225798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:04.362027Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:04.362027Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:1c24ece634f48b917b95a44c8cb936d637f81888eb7347480f812712e08920dc","observation_id":"344e40ab-683a-46e8-ac06-544c60507e86","resolution":{"observed_at":"2026-08-06T11:20:04.362027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:04.449437Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:04.449437Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:4c99d97255d3c1684f76882623ab9dd74634a0b8d33a22c10ba0827b2312ed5e","observation_id":"4a3a573c-ab27-40c2-9c0f-8740dd0a032b","resolution":{"observed_at":"2026-08-06T11:20:04.449437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:04.540947Z","title":"Bookstein","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:04.540947Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:22b0dc24b57f244a3d9d7a38735981e4082729351327886fd2c636c944444f40","observation_id":"cae2e80b-56d5-4248-a97d-8d35fdee5a88","resolution":{"observed_at":"2026-08-06T11:20:04.540947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:04.626785Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:04.626785Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:0cf927e9fdcf91c01fd3210ff8055e825a9fb11cea9fbca366512cff0026c0c1","observation_id":"419f4c20-e2ae-4986-a5ca-eb17c156e115","resolution":{"observed_at":"2026-08-06T11:20:04.626785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:04.701121Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:04.701121Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:1fc7fe9b9d791d738f36b1c1b214c6a5b97cef70d4389027c2aa2a47d5246139","observation_id":"94ceee40-ea23-4883-8c42-4bf75edafab5","resolution":{"observed_at":"2026-08-06T11:20:04.701121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:04.870680Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:04.870680Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:80ec3734c093ac6c33e0c95c8282b18eab5ccc084f67f19fac99f5bd22f8a711","observation_id":"f6502fcd-d913-4fc7-ba5c-c7c52060b0fa","resolution":{"observed_at":"2026-08-06T11:20:04.870680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:04.977933Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:04.977933Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:3146a251d2cd7f013392dd9eb7e9be303eaa67b4908de5f5181838c2c8fe40a9","observation_id":"806a4565-2184-4b1f-83f0-3d26e627327a","resolution":{"observed_at":"2026-08-06T11:20:04.977933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:05.014486Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:05.014486Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:4650831c2e08c3cce736bc83cd824b7ca8f6f96497c903094dde1241bc90204a","observation_id":"12738999-007a-4cac-be85-f0ca74614326","resolution":{"observed_at":"2026-08-06T11:20:05.014486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:05.127610Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:05.127610Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:85d6700e233ad102d515b9da43b13bb6c5e2db413bc2b988bbfcfcf0c1e03425","observation_id":"0e0b54a9-04c5-42ce-b4c9-6a69ce697835","resolution":{"observed_at":"2026-08-06T11:20:05.127610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1709.06158","last_updated":"2017-09-18T20:34:48Z","snapshot_observed_at":"2026-08-02T16:47:23.623541Z","submitted_at":"2017-09-18T20:34:48Z","title":"Matterport3D: Learning from RGB-D Data in Indoor Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.06158","snapshot_observed_at":"2026-08-06T11:20:05.285678Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:05.285678Z"},"links":{"cited_paper":"/paper/1709.06158","citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:254bbfc88719c2b58c04dbf94a4746d4c564a7f79bece7885e636d83765abb95","observation_id":"5a9b3105-aa6c-4a56-99b7-3f25d7612926","resolution":{"observed_at":"2026-08-06T11:20:05.285678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:05.399392Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:05.399392Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:bf0a27da94132b05ca07e136f892e757450511d9a5ef96be1f0a745896a5cf01","observation_id":"7251bf7a-8099-475c-adcf-387958671dc9","resolution":{"observed_at":"2026-08-06T11:20:05.399392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:05.560957Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:05.560957Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:3750e0d645bc3ba54b11335f25859f50178f879d752b1aed7cbc507a23cf292f","observation_id":"7df89068-4d5d-4152-a8d0-6379debc6b2e","resolution":{"observed_at":"2026-08-06T11:20:05.560957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:05.688876Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:05.688876Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:ad811e9833ba3b61d741e15488e0faad4329b93cb14cf6779a3ae0fe70957891","observation_id":"e7b4a592-47cf-4720-a569-9668c758f49f","resolution":{"observed_at":"2026-08-06T11:20:05.688876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.06468","last_updated":"2021-04-13T19:18:19Z","snapshot_observed_at":"2026-08-04T20:31:36.034886Z","submitted_at":"2021-04-13T19:18:19Z","title":"ViT-V-Net: Vision Transformer for Unsupervised Volumetric Medical Image Registration","version":1},"cited_work":{"arxiv_id":"2104.06468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.06468","snapshot_observed_at":"2026-08-06T11:20:07.530050Z","title":"ViT-V-Net: Vision Transformer for Unsupervised Volumetric Medical Image Registration","venue":"eess.IV","work_id":"b752c398-7597-4ff1-a287-33d042451ec0","year":2021},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:05.823753Z"},"links":{"cited_paper":"/paper/2104.06468","citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:47d87c78e2ce04db0a8ed462cc82ba280fe874e54d6ac4483df2c9f0047b4b4f","observation_id":"20460cf2-6263-48f5-a6c8-7098c72715f7","resolution":{"observed_at":"2026-08-06T11:20:07.533788Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:05.987758Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:05.987758Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:245820cb5372dad54fefb50256f93e5e5556a738db48367bb2867e387bc5592f","observation_id":"0ecbb0e1-c7e3-4c43-a217-0554d84ab6b2","resolution":{"observed_at":"2026-08-06T11:20:05.987758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.156075Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.156075Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:55fb1311edf17a32ef76e8b96800fc7e4c503600138a5af25b0c409ca618035e","observation_id":"63893628-3a6e-4ec8-85be-f6b8e6050501","resolution":{"observed_at":"2026-08-06T11:20:06.156075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.00451","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:07.503450Z","title":null,"venue":null,"work_id":"96770602-eee8-4771-a938-6b601a557754","year":2025},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.334069Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:13aed2f028c6411f0ad815ce12c6a13e14f7811dbbbae1395f3a891fb2fe74ff","observation_id":"39cc4687-6719-4edc-a027-af12b89dd15b","resolution":{"observed_at":"2026-08-06T11:20:07.508676Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.06794","last_updated":"2023-06-05T17:55:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-14T17:24:07Z","title":"PaLI: A Jointly-Scaled Multilingual Language-Image Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.06794","snapshot_observed_at":"2026-08-06T11:20:06.410884Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.410884Z"},"links":{"cited_paper":"/paper/2209.06794","citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:a5455317c7e7c93a9ba36989867e1181f6d4fbd43a0f5191c45eb5fbb2772e9d","observation_id":"a1f77044-e3f5-4588-829f-e0e1e4e69bcc","resolution":{"observed_at":"2026-08-06T11:20:06.410884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.448424Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.448424Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:f5d54b737283ea0974dfbf6d3d13ccb26ed760e518a42944844e9d0bdc6aae1f","observation_id":"a4fc9eec-f004-430b-9a3f-2a6a5ae9daa1","resolution":{"observed_at":"2026-08-06T11:20:06.448424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.481605Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.481605Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:5106c6d868d69d12d859fcbd0e6b6846ddebeb37f0dc827904ee75de8d0eb1b8","observation_id":"cab58929-421c-4278-b2aa-d2a0a85e38f5","resolution":{"observed_at":"2026-08-06T11:20:06.481605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.485161Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.485161Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:30d86b132a8e237e090d68001b01ff782d79f05b06a8ca418a929a17368da70e","observation_id":"89fa2b21-31b4-44c1-ae2d-7f4c1f0883ee","resolution":{"observed_at":"2026-08-06T11:20:06.485161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.488024Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.488024Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:d194a6dc9718598931773fd5aa7b22eba54e520b1b637ca2e45eb93b2882ccad","observation_id":"705bb9a0-0802-4e19-bf8b-4cd90dee28dd","resolution":{"observed_at":"2026-08-06T11:20:06.488024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.491081Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.491081Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:2f9c5c96568151183f2566cce63861885fc26962462bb89ea0630f7df1e4e96e","observation_id":"ffa99f08-bf0e-438b-aca0-cd4e4ba2d1b7","resolution":{"observed_at":"2026-08-06T11:20:06.491081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.494048Z","title":null,"venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.494048Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:ca72901fe01f62d35bb8b1b35d1fb7677fda00f1d657b34322513953b8abaede","observation_id":"689a34aa-615a-4168-804c-3b26c6f52829","resolution":{"observed_at":"2026-08-06T11:20:06.494048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.497101Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.497101Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:60047be95f011b2222aa33eb5a2a6c0b81eb685160e86ca5d82ade9c954d535f","observation_id":"856e1b54-8bcc-4c46-bf25-ce521c6f544b","resolution":{"observed_at":"2026-08-06T11:20:06.497101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.499823Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.499823Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:cbde17499dd4a96241e914d7f6d59f6887db78ce79dbbcab345767652b086126","observation_id":"80871278-bf9c-4737-b04e-9a6e74862e58","resolution":{"observed_at":"2026-08-06T11:20:06.499823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.502747Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.502747Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:d81b09c3eaec68b3c2465ad2ce9302973f27055217a2b0593073470da7b1583a","observation_id":"db7744cc-d1f8-44b5-8dc4-c02c251d8daf","resolution":{"observed_at":"2026-08-06T11:20:06.502747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.505505Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.505505Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:0b57c3d678eb736443284921c99c22d124463676900ff7cf205fbd0602e5b916","observation_id":"18afa169-9077-42d8-86a3-ca0ea26fd540","resolution":{"observed_at":"2026-08-06T11:20:06.505505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.511747Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.511747Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:c48ee4c1fcb68ce8f59c7b00a9f43bedad9f300e0977f8e77ace03d8b1b93b7c","observation_id":"cb84eaec-9d32-4690-9297-f92f2fdd192a","resolution":{"observed_at":"2026-08-06T11:20:06.511747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.514560Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.514560Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:4f243c458173c98aa5c72a1fb0c9366ec118ee881c9f0be1f3fdf74068ca9c54","observation_id":"e64c739e-bf11-46cb-a311-7ec8474524c2","resolution":{"observed_at":"2026-08-06T11:20:06.514560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.517382Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.517382Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:c329b63619e709c002419b5f3d7c244622345a83d3669ec5406019d238156e19","observation_id":"6c0dfc95-c7c5-4f9b-8e87-b458db5af77b","resolution":{"observed_at":"2026-08-06T11:20:06.517382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.520035Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.520035Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:f4f302ec6caae0f8058e55a6c1dda22a7dae94bd3758d582fa71a9f1169ce2c4","observation_id":"9b64da9b-f2f7-4745-8376-fbf80a9841c1","resolution":{"observed_at":"2026-08-06T11:20:06.520035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.522784Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.522784Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:17cb1871e4582967331ab3479461cd6fdfd78025a072dd21d304f03b76afc4e0","observation_id":"d34d60cd-8d1b-439e-9e42-010177495a7a","resolution":{"observed_at":"2026-08-06T11:20:06.522784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-08-08T22:04:13.117781Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-08-06T11:20:06.525655Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.525655Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:8bb0e7edde442ebc438049fd185e72879d9f74ba0ae3778a9a1b379d9401a0ce","observation_id":"8fab6844-6c40-4465-b29e-85f0c1b5bff2","resolution":{"observed_at":"2026-08-06T11:20:06.525655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.528515Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.528515Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:c126504405c0694079f182730b69ef1e3637a1374c65d9e41fdedf074ba1757f","observation_id":"fcaaa753-d339-4781-8a18-94c999f30066","resolution":{"observed_at":"2026-08-06T11:20:06.528515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.531704Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.531704Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:d93c2a317e637d5c6bc63f2741b107c817b30bf852fa2f9bc17d2bd614de375f","observation_id":"54c8ffa6-908a-4c13-8b4f-4b26ceb9c26b","resolution":{"observed_at":"2026-08-06T11:20:06.531704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.534340Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.534340Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:f27039ad40e2bc4aef11d5c8558a06577b1e305d6cafefb2310a2d60ac2b8637","observation_id":"810da1ed-fb83-4366-bd69-bff2f63e4fe6","resolution":{"observed_at":"2026-08-06T11:20:06.534340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.537688Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.537688Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:76a85952b0f26833874d7e54770f3e3582ff87452a1c52b5ead69ad39f06a9e0","observation_id":"067d9803-c3f7-4ae4-9d45-6740084c3cbb","resolution":{"observed_at":"2026-08-06T11:20:06.537688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.05612","last_updated":"2018-07-29T19:11:57Z","snapshot_observed_at":"2026-07-06T05:51:36.145913Z","submitted_at":"2017-07-18T13:51:32Z","title":"VSE++: Improving Visual-Semantic Embeddings with Hard Negatives","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.05612","snapshot_observed_at":"2026-08-06T11:20:06.540382Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.540382Z"},"links":{"cited_paper":"/paper/1707.05612","citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:05a2aa6cfe5e4407193165bc2bf84dbd61e1084384ff0a47a885be13542d6ddc","observation_id":"30784ce5-a349-4172-9c88-5b8353d92e4c","resolution":{"observed_at":"2026-08-06T11:20:06.540382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.543386Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.543386Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:7d70d015ff0c2ee8a09862237bf4342609367131380de10bd443654da513ea93","observation_id":"bb846d5f-8a8d-4d55-900b-6e0ff0623bbc","resolution":{"observed_at":"2026-08-06T11:20:06.543386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.546059Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.546059Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:215772feb45ce1dd53dfbd2316793c73e774aaed63a8b65e3386649c11f289f8","observation_id":"adbdbb2d-c207-47f2-a3df-a99b8acf305b","resolution":{"observed_at":"2026-08-06T11:20:06.546059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1405.5769","last_updated":"2015-06-24T09:16:28Z","snapshot_observed_at":"2026-07-06T03:44:25.607525Z","submitted_at":"2014-05-22T14:35:52Z","title":"Descriptor Matching with Convolutional Neural Networks: a Comparison to SIFT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1405.5769","snapshot_observed_at":"2026-08-06T11:20:06.548682Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.548682Z"},"links":{"cited_paper":"/paper/1405.5769","citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:54ce68bf30a87ffc6f0dadf0c9ffd04139bc154de743be0c41eab90b87e7ad30","observation_id":"178662d5-d060-4238-841d-807ad1d6e3ff","resolution":{"observed_at":"2026-08-06T11:20:06.548682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.551567Z","title":null,"venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.551567Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:6a975876530422a2e015023b26dffb7935b4a7bb8f7d32d17498f26945011a3f","observation_id":"d6afbd83-bfb7-4bbd-8d58-b5188718ef93","resolution":{"observed_at":"2026-08-06T11:20:06.551567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.554438Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.554438Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:dc7ed98db832670bbae5febbdf2ffe2798b8f9584a3b3fdf8671c6558c6f2cba","observation_id":"af40dff5-f4ec-4b96-8507-09c72512e6c6","resolution":{"observed_at":"2026-08-06T11:20:06.554438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.557471Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.557471Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:c1560abcc5315b9774b13a47b4529e1d39473c54ea8151b01b16efb6534d9edc","observation_id":"d4c456f2-2e88-486c-a100-7b7595535185","resolution":{"observed_at":"2026-08-06T11:20:06.557471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.560016Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.560016Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:84e6348853166c8f2a904644031bdc2581ae268b6e0a49cb7243bee1dec627c7","observation_id":"a327e6b3-7ad8-47f1-99d8-5ac6b1786a6d","resolution":{"observed_at":"2026-08-06T11:20:06.560016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01847","last_updated":"2016-09-24T01:58:59Z","snapshot_observed_at":"2026-07-06T04:58:59.748799Z","submitted_at":"2016-06-06T17:59:56Z","title":"Multimodal Compact Bilinear Pooling for Visual Question Answering and Visual Grounding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01847","snapshot_observed_at":"2026-08-06T11:20:06.562793Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.562793Z"},"links":{"cited_paper":"/paper/1606.01847","citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:fec832a0f36660ced4f7db4fae97c5b73d52b01a95cb37086259453df4fc45cc","observation_id":"6053ddad-b56c-4401-bc30-a043cbfbc3d8","resolution":{"observed_at":"2026-08-06T11:20:06.562793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.565643Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.565643Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:56a56f77eac3c949999b4f45208d71444ff2937bcfc6706138739ce673a2587f","observation_id":"6de8164b-c4de-4d41-9f79-40b37cd589ca","resolution":{"observed_at":"2026-08-06T11:20:06.565643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.568562Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.568562Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:df244c2fc6c32f695c5b5bbb1fc4418965095fddd813842d7e2de63ba912e618","observation_id":"6614512f-1456-4f7f-a219-70926c728d28","resolution":{"observed_at":"2026-08-06T11:20:06.568562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.571097Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.571097Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:a3af7ad13018994f4830e2f687dcb5e71708506e7905a338944a74bccd8e2536","observation_id":"cec0b073-7c76-43b8-b34f-a4a4b190c041","resolution":{"observed_at":"2026-08-06T11:20:06.571097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.573760Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.573760Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:ab1e5e151cd46c1bf7b5131d1104c6ad5ab11f6d13c85bf37bea3bebde1042a1","observation_id":"71326a76-f2cb-4899-bf6c-ca9708434e54","resolution":{"observed_at":"2026-08-06T11:20:06.573760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.577030Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.577030Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:3380526d36f4865d05f416648988a3ff0e865906bc8487ee5e6bf09a3bba94be","observation_id":"e02cefd6-7abc-4f55-b732-b63cdc535779","resolution":{"observed_at":"2026-08-06T11:20:06.577030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.13921","last_updated":"2022-05-12T01:27:40Z","snapshot_observed_at":"2026-08-08T10:08:57.896975Z","submitted_at":"2021-04-28T17:58:57Z","title":"Open-vocabulary Object Detection via Vision and Language Knowledge Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.13921","snapshot_observed_at":"2026-08-06T11:20:06.579849Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.579849Z"},"links":{"cited_paper":"/paper/2104.13921","citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:f1f6421c360bb800c747b443c9e2b16faaa7cfb5f6a4fca24df03f54d6c54a3c","observation_id":"888fca38-9277-4e0d-90e0-db71e561dd1c","resolution":{"observed_at":"2026-08-06T11:20:06.579849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.582667Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.582667Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:5f9628ff8125e9eac3a5c228b0d84b05c89281a07cc752297bc53315fa246795","observation_id":"21637d61-3e9f-4b8c-87d3-0ada0b8a6327","resolution":{"observed_at":"2026-08-06T11:20:06.582667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.585258Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.585258Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:9e218d99913c14d9b31c6f673a1ad3c9e467d0274fd80d16b219b3bcebf47caa","observation_id":"7d686c12-c4f7-422f-9034-10c276bf648a","resolution":{"observed_at":"2026-08-06T11:20:06.585258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.587979Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.587979Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:c4a84ba46ff3d554f0dd52639269e1e279e0561aa8a569776f829a737be9e21d","observation_id":"88fe0d18-f0fc-467e-8176-2f53ffdd686b","resolution":{"observed_at":"2026-08-06T11:20:06.587979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.590655Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.590655Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:9796773541089f0bb7be15210cf1ea5a9017554203b3d8f9b5c9cff237e3f51d","observation_id":"14036201-cc83-42ca-bd90-5edfb332428e","resolution":{"observed_at":"2026-08-06T11:20:06.590655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.593507Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.593507Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:c70c6765ebc7f6112e7d488c2f353ef078160c5d206077c9e10722897319f291","observation_id":"855e9b78-d2a6-4f3d-a175-0357139cc740","resolution":{"observed_at":"2026-08-06T11:20:06.593507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.596453Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.596453Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:cbbddf98b9d7cdb7de9ac51c3f1b89a36c0630a0daa36526e01e3bc5a3d75db7","observation_id":"6b1f4ca4-719f-4392-acc7-14eae900b4dd","resolution":{"observed_at":"2026-08-06T11:20:06.596453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.599246Z","title":null,"venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.599246Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:e3af728ad3e1b4f0bff9ef65f784afea1999e4d67369e9ed997de9b38aac2292","observation_id":"8f7f23dc-a3f1-4460-a154-6427707a736a","resolution":{"observed_at":"2026-08-06T11:20:06.599246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.602196Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.602196Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:21e786d758df724adbfbb641a7a4c78830bf0e53d7e8b0a43d2f7fb199d37e92","observation_id":"a579695e-c193-4efb-a04e-7155688300fd","resolution":{"observed_at":"2026-08-06T11:20:06.602196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.604988Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.604988Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:1effce45dd89db3f36e080194b78a75d8cc2284aa61d2d6aeb99a3f995fcc2f2","observation_id":"4a5ba232-c1fd-4ef3-8c04-804aa7187182","resolution":{"observed_at":"2026-08-06T11:20:06.604988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.607590Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.607590Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:9e01557e421e17c682ef7e12cbce6cb4523bf4673dacb1f7675d5d8c4fdb4b97","observation_id":"cc7aab6b-c76f-4138-b932-3ea9592edbc6","resolution":{"observed_at":"2026-08-06T11:20:06.607590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.610512Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.610512Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:6266f8c3c7a5fadfa7015989f51f36cdcdd20c56d8d90804afd4f5c7394192a7","observation_id":"e67fa3e4-3af9-4187-a097-16d2141f36ac","resolution":{"observed_at":"2026-08-06T11:20:06.610512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.613139Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.613139Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:e2ba010549cef7facd09583df933d5a40e42bb0bb20760f3b9a65e27eeec9267","observation_id":"b1f36bc7-53f2-409b-9446-1f606b7f91ba","resolution":{"observed_at":"2026-08-06T11:20:06.613139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.615633Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.615633Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:fabe8b70a030238779cd5464c1b1ac6bfee1ae695ddb61e8075253e4a104173f","observation_id":"903661db-4452-4320-ad4f-7be7a918786b","resolution":{"observed_at":"2026-08-06T11:20:06.615633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.618163Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.618163Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:1df456e1542c305b6a1d9e3e270da500c57e5f9a028d3117c21e4cb6243b0c8a","observation_id":"9bfd5bad-b649-4df8-ab06-e7fb61cd501e","resolution":{"observed_at":"2026-08-06T11:20:06.618163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.621356Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.621356Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:4a1e40cc72c5bf9191f16cb27b7a936f7b4c507aadb80165a2aaab7708b392ab","observation_id":"2ca6ddc7-ae7e-4586-9315-6b8339930835","resolution":{"observed_at":"2026-08-06T11:20:06.621356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.623827Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.623827Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:b1a1b41f8470b5500db9a392613d8bf587905ceb1652ba7e15f217b431d37021","observation_id":"6a1702e4-627b-4d61-bfb4-d029a7425511","resolution":{"observed_at":"2026-08-06T11:20:06.623827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.626432Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.626432Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:5b7a7708c192fe954393b5fa14c9377ee57fe134922fcd0d93a5ffd1b5c09259","observation_id":"c410a4f1-9351-4171-a802-d3acbe56e620","resolution":{"observed_at":"2026-08-06T11:20:06.626432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.629878Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.629878Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:51411371bc398364842c69c76b6088af3ed81a5359a9da3141e08e3f9b8b6d39","observation_id":"bf6a782c-095b-45e7-af21-cabe6bd73551","resolution":{"observed_at":"2026-08-06T11:20:06.629878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.632922Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.632922Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:52f910f7af0e175d6443b47016cea7fcd81a8ddc8ef025863444eff9c24cdb77","observation_id":"dc7c85dc-74a4-46f8-bc54-7906bb3c4aab","resolution":{"observed_at":"2026-08-06T11:20:06.632922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.635725Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.635725Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:5f2c8495f200760c533073e51de2cc3126bbeb8ab82cfdf7522442ceb5df3191","observation_id":"d88e3f40-0a19-4e4e-9d7e-84d55eb48a9f","resolution":{"observed_at":"2026-08-06T11:20:06.635725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.638475Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.638475Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:a60c5ede9e6708027f724a0c5ec9ed3c429ae12f153eb992e958cb5b3c39186a","observation_id":"717c8a6e-a52c-4761-9b9d-bbdf96485e70","resolution":{"observed_at":"2026-08-06T11:20:06.638475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.641483Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.641483Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:1df2b9956d6d2f953cfa67e82c2e286fdfa597e8f6faa613115dd51f12b25e3a","observation_id":"5bc12218-594d-4118-8f03-1680891cd4f8","resolution":{"observed_at":"2026-08-06T11:20:06.641483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.645684Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.645684Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:78974bb46a3b38fe63c27673273d961af3c22a24d64246fdbd220ce3eb5d7a60","observation_id":"52a16813-f888-4bfa-aad0-3a6a1bf970e8","resolution":{"observed_at":"2026-08-06T11:20:06.645684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.652413Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.652413Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:a622131557c221a0f1c17f74b658556255190a0136381a95e0dcaaa793060b1b","observation_id":"b3f76cef-c7a3-4a93-8e3f-57b14cc14f04","resolution":{"observed_at":"2026-08-06T11:20:06.652413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.655227Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.655227Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:9732d97e8264de9f6bc228bff069ad3c539f9bca80f1b64afdd56c413367b1f2","observation_id":"17728b80-e744-4c81-ab7c-db8f8b1f51f6","resolution":{"observed_at":"2026-08-06T11:20:06.655227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.657914Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.657914Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:a820c63edd32b809e027c0ee560a0203331dfb2b6f850faf7a881c83d56a5823","observation_id":"c8726f92-7e2e-4334-8dfb-1ef1d72ad7ca","resolution":{"observed_at":"2026-08-06T11:20:06.657914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.660570Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.660570Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:6df11fa428078455cf49fff6380e56363ea5f5536629cb1f2f9df4e2334db747","observation_id":"cadac700-d292-446b-af3a-c4738b51cfd7","resolution":{"observed_at":"2026-08-06T11:20:06.660570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:20:06.663207Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.663207Z"},"links":{"citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:bc6a3dfd82ecbebfe61a05d1ccdbe73fae192fe5d9095cf65e3b1cd27ccca368","observation_id":"22e2b368-9a25-43d3-a8bc-919dfd2eb2f9","resolution":{"observed_at":"2026-08-06T11:20:06.663207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T03:11:19.748474Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":97,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":254},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 100 of 254 outbound references and 2 inbound Pith citation observations for arXiv:2507.22791."}