{"as_of":"2026-08-10T09:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3783cd7689092f591a4911874fc651a6699a74c58f59ed665ec0e1830396ceb0","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:37:13.701589Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.07802/citation-record","integrity":"/paper/2507.07802/integrity","json":"/paper/2507.07802/citation-record.json","paper":"/paper/2507.07802"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.881167Z","title":"Multimodal federated learning in aiot systems: Existing solutions, applications, and challenges","venue":null,"work_id":"a2f69d5b-c9cc-436e-b98a-27856eadc534","year":null},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.420171Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:c86aa184d8834040b0152561abce92217d3a76d5d6c841fb4e646e17d04db316","observation_id":"29824960-47d2-4a26-84d6-a3dfc402161f","resolution":{"observed_at":"2026-08-06T18:37:14.887631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1702.01992","last_updated":"2017-02-07T13:05:19Z","snapshot_observed_at":"2026-08-05T13:29:33.669402Z","submitted_at":"2017-02-07T13:05:19Z","title":"Gated Multimodal Units for Information Fusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.01992","snapshot_observed_at":"2026-08-06T18:37:13.426170Z","title":"Gated multimodal units for information fusion","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.426170Z"},"links":{"cited_paper":"/paper/1702.01992","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:7f2b62e3235364fcadf0d5285a6081b9ada28e49741bc5d7b731a6c18dc08eca","observation_id":"d0f7061e-57b4-4b8c-8f3d-fde0e1e47dfd","resolution":{"observed_at":"2026-08-06T18:37:13.426170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.861607Z","title":"Vivit: A video vision transformer","venue":null,"work_id":"579aaf54-f468-4394-bb98-c041e272b459","year":2021},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.432861Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:d3b1ec2cfa3a786654eb8f63eec90024a70439f34fda3dc139552215f09af97f","observation_id":"f8e94412-97da-4f4f-a7ad-e6f1b7b25c83","resolution":{"observed_at":"2026-08-06T18:37:14.866741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-06T18:37:13.437969Z","title":"Layer normalization","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.437969Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:db968734f11461049544b7ea18fab94779cb8ac465cdbaada0c1acb8e27002a7","observation_id":"29d58b42-ffaf-41cb-aaad-14227c8a6e8a","resolution":{"observed_at":"2026-08-06T18:37:13.437969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.843462Z","title":"Sharegpt4v: Improving large multi-modal models with better captions","venue":null,"work_id":"c1fa3121-9405-4642-b4e1-0235ce0448a1","year":null},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.443770Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:3970cd46b57022851bf8e0f975f65494a62656da02ebe88b1b00c64a1ceae3c3","observation_id":"f990f6de-3dff-4c5c-a8d8-fd6725a46b46","resolution":{"observed_at":"2026-08-06T18:37:14.848876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.827573Z","title":"A fine-grained self- adapting prompt learning approach for few-shot learning with pre-trained language models","venue":null,"work_id":"fc9bcb95-4423-43fb-bc3c-35a3dc7c244f","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.448863Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:03127801f67cabffaf930f7b40a2bfc380e2fb9ebb92d68dfd4a5d0967c2aee7","observation_id":"9c4cbc9e-61c8-4f40-a36e-ec1bb4712fc2","resolution":{"observed_at":"2026-08-06T18:37:14.832544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.810496Z","title":"Retrieval-augmented hypergraph for multimodal social media popularity prediction","venue":null,"work_id":"cda5c1ca-d2dc-4929-8421-d8c0846929e8","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.454468Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:a1745f63501a285aaf9b257acb0498a23ba2b4f7f80b7e1f376ed29c3e125883","observation_id":"37d500be-722d-4d45-890c-c0911e873262","resolution":{"observed_at":"2026-08-06T18:37:14.815670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T18:37:13.459599Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.459599Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:83a6173bd963d2279eff8c0a08131923d35c5423a92fc5284ca1330bbb189dbb","observation_id":"c3fb0cec-546d-4502-b074-42d45886a880","resolution":{"observed_at":"2026-08-06T18:37:13.459599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.793364Z","title":"Mfhod: Multi-modal image fusion method based on the higher-order degradation model","venue":null,"work_id":"01e8d142-37d8-4762-a0c5-6da374f3e34b","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.466222Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:2dfaca2b348d74823dca1c7f603b52393477c25d947f8766683a36156a0b409c","observation_id":"81606e5c-6139-406d-91e6-3a7624fc2176","resolution":{"observed_at":"2026-08-06T18:37:14.798139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.776089Z","title":"Uncertainty-aware align- ment network for cross-domain video-text retrieval.Advances in Neural Information Processing Systems, 36:38284–38296,","venue":null,"work_id":"3584a595-9a82-41bb-9045-0bfafecd7f10","year":null},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.475320Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:6d47e6a78f95dc369fee452e8c6c83760f11f3ba58f072be14ee25f1e65a47bb","observation_id":"85665874-10bf-4f86-8a81-52068c30dfcc","resolution":{"observed_at":"2026-08-06T18:37:14.781808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.760583Z","title":"Dual alignment unsupervised domain adaptation for video- text retrieval","venue":null,"work_id":"d39870cc-4892-4451-bc4c-7791abc7345f","year":null},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.480887Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:7356707f76d4720c87314d4c1bb3c14eecc46659c139840294083e68bb13312d","observation_id":"71de438a-9358-470b-accb-70dba9c16c04","resolution":{"observed_at":"2026-08-06T18:37:14.765461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.743939Z","title":"Mixgen: A new multi- modal data augmentation","venue":null,"work_id":"856075c9-bbd0-48be-9004-60ce813ecbe8","year":2023},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.485972Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:7e52693f14bf729d656db2b19a6d078b42285e9fb9581fb5f80b55994f91c66a","observation_id":"5e755984-60dd-47d1-9089-ef25ceb7f0f5","resolution":{"observed_at":"2026-08-06T18:37:14.748736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.727201Z","title":"Mapfusion: A novel bev feature fusion network for multi-modal map construction","venue":null,"work_id":"2fb24001-c126-46be-919e-0b7df2ea60eb","year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.491491Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:ac6aa2db9120891f0a248354d83ce89c5982a3d5dc2088b865d76f5919abe192","observation_id":"77bf2cbe-f265-4dce-bbfb-aaee999d2c40","resolution":{"observed_at":"2026-08-06T18:37:14.732151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-06T18:37:13.497259Z","title":"Gaussian error linear units (gelus)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.497259Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:ab17edbfd9a2f696e58230d9cb99b80d04a344399474c86ebe556102e9c6de29","observation_id":"37d9903f-bbff-438f-836e-c7e6d377ff26","resolution":{"observed_at":"2026-08-06T18:37:13.497259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.711124Z","title":"Robobrain: A unified brain model for robotic manipulation from abstract to concrete","venue":null,"work_id":"870f6e4a-5224-407f-a521-745fd16f961f","year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.502288Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:f4c1b902ab7815199ede84e95f74b731695bbc3c6b84ac8970c31955fb9467d3","observation_id":"ea79b0ad-483f-46ef-bbb1-0673f0ea3b0c","resolution":{"observed_at":"2026-08-06T18:37:14.716541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.690626Z","title":"Cross-modal implicit relation rea- soning and aligning for text-to-image person retrieval","venue":null,"work_id":"ff1214bd-2523-447b-a06d-7608778e614d","year":2023},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.507508Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:3bc032d662ae90134215964ec9371e839f85f56e37ba7d3233c274aad9e9cee8","observation_id":"f50bd447-bf4e-4e96-af8a-42645db08538","resolution":{"observed_at":"2026-08-06T18:37:14.698866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.674537Z","title":"En- hancing industrial prognostic accuracy in noisy and missing data context: Assessing multimodal learning performance","venue":null,"work_id":"b440cec5-4983-40ce-81fd-9486d699cf17","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.512559Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:25d40e03e2246f354a2af0bab9c954c1d90f28e370fb0b0822f4a6a263563f4b","observation_id":"eecdd19d-d9e8-48c8-af83-57aeb708c98d","resolution":{"observed_at":"2026-08-06T18:37:14.679304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.657466Z","title":"Exploring contactless tech- niques in multimodal emotion recognition: insights into di- verse applications, challenges, solutions, and prospects","venue":null,"work_id":"14e181ae-89d9-42c0-b225-e585531f4f80","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.517722Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:93b8ebfbec0442cf0922da356543ba752bcd64040353bd55be058faecd3d5d3a","observation_id":"45a10e59-fc49-47c3-b718-23a829dbab3a","resolution":{"observed_at":"2026-08-06T18:37:14.662398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.640081Z","title":"Maple: Multi- modal prompt learning","venue":null,"work_id":"b4ab55ce-d28f-4bbd-9791-968b015e97df","year":2023},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.522485Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:0ebbe6aa27e83d48cd0a871fc4ff97d3cfbcfeb55f8638184f45ff88eb45c812","observation_id":"4ba418a1-379e-40c0-9e56-58e284417763","resolution":{"observed_at":"2026-08-06T18:37:14.645348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.624035Z","title":"The hateful memes challenge: Detecting hate speech in multimodal memes","venue":null,"work_id":"106a6298-5b7d-4a4c-8e10-286ebd88ff59","year":2020},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.527275Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:e7bf226750f34dc595ed3213d446eac113f8c9140b93f619de3c484cb0c030c3","observation_id":"562eb04f-e921-4680-8c02-e8238374632f","resolution":{"observed_at":"2026-08-06T18:37:14.628705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.606410Z","title":"Missing modality predic- tion for unpaired multimodal learning via joint embedding of unimodal models","venue":null,"work_id":"04370b27-df00-4bb0-8aa1-ffb68e113616","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.533911Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:47797abf1e9bc9396d1647fc40b704287225f6412d46b8d8f939d22dcec2e5a2","observation_id":"b95bb752-84b3-4e0d-9f23-312d59c22121","resolution":{"observed_at":"2026-08-06T18:37:14.611757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.588436Z","title":"Do you remember? dense video caption- ing with cross-modal memory retrieval","venue":null,"work_id":"f9920b49-c46a-41f6-976a-c69964472c65","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.539597Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:743578855d20ac6c4ac833255b8b66dd5852b854cd7c93086e12f8b50049b055","observation_id":"fb281050-dacd-412d-9d16-631421fc465e","resolution":{"observed_at":"2026-08-06T18:37:14.593348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01120","last_updated":"2025-06-14T00:49:08Z","snapshot_observed_at":"2026-07-06T20:15:40.852454Z","submitted_at":"2025-01-02T07:39:48Z","title":"Retrieval-Augmented Dynamic Prompt Tuning for Incomplete Multimodal Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01120","snapshot_observed_at":"2026-08-06T18:37:13.545125Z","title":"Retrieval-augmented dynamic prompt tuning for incomplete multimodal learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.545125Z"},"links":{"cited_paper":"/paper/2501.01120","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:fdd420f48a87160eb4cc0a6f2146f4a903646050aacb4889b8dc62771f3b0720","observation_id":"dd0e78d9-ab23-42cd-902a-4f3c0eb0a959","resolution":{"observed_at":"2026-08-06T18:37:13.545125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13898","last_updated":"2025-03-06T11:38:00Z","snapshot_observed_at":"2026-08-06T19:09:10.512808Z","submitted_at":"2024-01-25T02:25:23Z","title":"Cross-Modal Prototype based Multimodal Federated Learning under Severely Missing Modality","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13898","snapshot_observed_at":"2026-08-06T18:37:13.551429Z","title":"Cross-modal prototype based multimodal federated learning under severely missing modality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.551429Z"},"links":{"cited_paper":"/paper/2401.13898","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:0586d5c749ef02feb37b019ca98442f548f1422dfb9573b1ea04037463b776c5","observation_id":"0e24097f-3669-49d9-b958-25fe42510cdf","resolution":{"observed_at":"2026-08-06T18:37:13.551429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.571915Z","title":"Multimodal prompting with missing modalities for vi- sual recognition","venue":null,"work_id":"bb876046-4cc4-423e-8025-281b7dadaa3a","year":2023},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.557711Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:b434e56c8327e05034832bdc6383790a78cca2065aa40f023ebbbd1d26c1d334","observation_id":"15120a6f-1ae5-4105-9529-c727bd4d6781","resolution":{"observed_at":"2026-08-06T18:37:14.576772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:13.562777Z","title":"What foundation models can bring for robot learning in manipulation: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.562777Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:f1637c7e0b35a882a2ce6f22dabe02c8ad582b281ce9dd2a568dc34d7e8bc024","observation_id":"5402fef5-b762-4f35-a000-3522a75de606","resolution":{"observed_at":"2026-08-06T18:37:13.562777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.553169Z","title":"How to configure good in-context sequence for visual question answering","venue":null,"work_id":"aff9cd98-a537-4d0f-9783-9fc0c3af016a","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.569460Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:1ce5cd22ed97d59a3a14b840d73a8928f1875439617fe35840fc9694dae43b4e","observation_id":"75420f2c-28c6-4702-bbdf-9175d31d18ee","resolution":{"observed_at":"2026-08-06T18:37:14.559231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.535404Z","title":"Tackling real-world complex- ity: Hierarchical modeling and dynamic prompting for multi- modal long document classification","venue":null,"work_id":"d1cc9523-088e-4a48-bfc0-d666e57e27fa","year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.575539Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:536cddb7ad7e8b0f19e11a9a50d3c4b20034a4b1ccfe5791d08aa6f227a5c39f","observation_id":"f72ca698-15d8-480e-9f05-dbb355128fd6","resolution":{"observed_at":"2026-08-06T18:37:14.540445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.518300Z","title":"Cross-modal causal relational reasoning for event-level visual question answer- ing","venue":null,"work_id":"7b1fde25-cbfe-49ac-abda-c16afa735cdc","year":2023},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.583735Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:339b82325f4c0a4733131bc73e4fdcbe424297a5995da08b00abc3e3e49fb1f0","observation_id":"6de5f2d3-7fb1-4956-9e98-0dae29a73fbf","resolution":{"observed_at":"2026-08-06T18:37:14.523862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:13.589686Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.589686Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:77ffa9ced6545dd7a308cae2b562b798e7580e2bcad8f3d7751e5ee473d6bc4b","observation_id":"ecf6230c-4e78-4039-adc1-6779e87e26a0","resolution":{"observed_at":"2026-08-06T18:37:13.589686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T18:37:13.594952Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.594952Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:9671135fa1b16a820066c77479c18f535e45f8f71a8f1daa8893edfe8f468112","observation_id":"71f7e8d8-50fe-4b47-8f23-a8063d776e71","resolution":{"observed_at":"2026-08-06T18:37:13.594952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.488848Z","title":"Multi-modal modality-masked diffusion network for brain mri synthesis with random modality missing","venue":null,"work_id":"640fe893-9817-4cd0-9b8c-eb2cc6b4d222","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.599767Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:1a76b3842f8a74962f6096d696f65697c5a736f81207cfe67ecf616be8a02199","observation_id":"7183cab3-a810-4635-8169-5f0b42ae1de3","resolution":{"observed_at":"2026-08-06T18:37:14.493831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.472102Z","title":"Semantically conditioned prompts for visual recognition under missing modality scenarios","venue":null,"work_id":"4800cd43-19cc-4385-8202-09684cbc4344","year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.605667Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:bfd3fa02b3394d7336a1e7e97520d74b8f0c4f913efd217f657f9c9691dd44bf","observation_id":"1ba48732-092d-4651-8ec7-c2fa7421cc76","resolution":{"observed_at":"2026-08-06T18:37:14.477067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.455541Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"d108b165-c5c0-463c-8d0d-eb0093b75515","year":2021},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.610864Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:b63af152a572eca5a7d05339d6d0961ff858c5d1e17fab3eceda606b5741e589","observation_id":"6352b3aa-7d51-47c2-a24b-560635b775af","resolution":{"observed_at":"2026-08-06T18:37:14.460440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.438361Z","title":"Deep correlated prompting for visual recognition with miss- ing modalities","venue":null,"work_id":"d24ad2b3-9186-4f6e-afe5-32fe788fa9d6","year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.615693Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:3532c2967c731dce4948d94ce8821d4f0d4fbd84d66ced4516568ace936eaceb","observation_id":"bc58cc0d-0697-40b1-8667-55cd64948704","resolution":{"observed_at":"2026-08-06T18:37:14.443089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.422256Z","title":"Drivelm: Driving with graph visual question answering","venue":null,"work_id":"92cb5124-5ea7-4614-9a65-418be758e483","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.620779Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:bbfe3a33b2d8697655b5de7e743a120f2f9facc6476ae36a6a6455309ac72a48","observation_id":"771209da-c689-4fc3-82b3-6683c23f9306","resolution":{"observed_at":"2026-08-06T18:37:14.427398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.405557Z","title":"Emotional video captioning with vision-based emo- tion interpretation network","venue":null,"work_id":"8714dcd0-4c43-463b-acb6-541d3e50f640","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.625853Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:f3a791f070b31a260e1d207e3200728e3c73e5c0a6d1291776457b9adb1394f7","observation_id":"01260b47-1eef-4f8e-a123-129ab953052b","resolution":{"observed_at":"2026-08-06T18:37:14.410844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.387586Z","title":"Strong and weak prompt engineer- ing for remote sensing image-text cross-modal retrieval.IEEE Journal of Selected Topics in Applied Earth Observations and Remote Sensing, 2025","venue":null,"work_id":"66d0609c-8397-453d-bd82-646a321cb168","year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.630665Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:571dff2a77c2bdd6f2fc759ae02a0b6bc6d2ebf1076d6913d261e2e18b0fb997","observation_id":"1fffe9f0-fe0f-46db-bbe8-d771d870db0e","resolution":{"observed_at":"2026-08-06T18:37:14.393043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:13.635122Z","title":"Reason- rft: Reinforcement fine-tuning for visual reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.635122Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:62275bf49bb494e496dc4a4680494e02247120023945200b3283a1aa1f736eb8","observation_id":"92552c73-82af-4b1a-848c-296027f52315","resolution":{"observed_at":"2026-08-06T18:37:13.635122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.369898Z","title":"Visualizing data using t-sne","venue":null,"work_id":"b5e33a91-190f-4a08-a959-02f9d194ec24","year":null},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.639953Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:c70d4dbbed88495b17e03abc47d7d2526675b7074d3ea62abb31262f55a005c4","observation_id":"84d31d32-1718-4d3c-a2a9-f42ee4972010","resolution":{"observed_at":"2026-08-06T18:37:14.375289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.351828Z","title":"Recipe recognition with large mul- timodal food dataset","venue":null,"work_id":"4de94184-5deb-47fe-9027-15f82dbe0e20","year":2015},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.644572Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:f16511c42dbcb751968cf6efae9fe03fea439feab822f23ec3fa0f647d2a106b","observation_id":"23c2961d-ceec-4580-9f68-7511e3dafdec","resolution":{"observed_at":"2026-08-06T18:37:14.357218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07825","last_updated":"2026-02-04T04:12:12Z","snapshot_observed_at":"2026-08-02T14:14:17.863359Z","submitted_at":"2024-09-12T08:15:39Z","title":"Deep Multimodal Learning with Missing Modality: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07825","snapshot_observed_at":"2026-08-06T18:37:13.649742Z","title":"Deep multimodal learning with missing modal- ity: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.649742Z"},"links":{"cited_paper":"/paper/2409.07825","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:5d7d96f388b71489d11e510e5dc1e50bfe39ff42fed89784437ff02eeef60792","observation_id":"f809d894-284a-4059-b3c4-662e38bbbecc","resolution":{"observed_at":"2026-08-06T18:37:13.649742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.334310Z","title":"Consistent prompt tuning for generalized category discovery","venue":null,"work_id":"2494d63a-ec42-426b-ac82-9be6def24edd","year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.655121Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:76d4aa5a03dd14bab20c6efcdb72a792fabbc554bf736ac06d55586a029b37f7","observation_id":"075a79b3-ed4d-4e6e-83d3-59e99431fef5","resolution":{"observed_at":"2026-08-06T18:37:14.339410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.315289Z","title":"Cpt: Colorful prompt tuning for pre-trained vision-language models","venue":null,"work_id":"5898e8ab-508c-4cf8-a619-ef12d08e45c5","year":null},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.661195Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:50ca8a7ce94f2cc8926b7b460baa289276246e187da113fc80fdbed7d52dd4c8","observation_id":"ae40199f-0210-4065-96e6-775b53ecc9be","resolution":{"observed_at":"2026-08-06T18:37:14.320478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.294970Z","title":"Dept: Decoupled prompt tuning","venue":null,"work_id":"fb3c3cb9-30cf-4abf-bb26-fb7534c1cc21","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.667097Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:36ca82a2138061c9a68f5ba56d2c9822eb98ee1ff84cdf0c389aea2dd0f2bdca","observation_id":"6369c64d-ff7c-4537-8957-96cf86b9c8d1","resolution":{"observed_at":"2026-08-06T18:37:14.303121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.276734Z","title":"Unified multi-modal diagnostic framework with reconstruc- tion pre-training and heterogeneity-combat tuning","venue":null,"work_id":"6fdce26c-03ec-4c33-95a0-60380cd737ff","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.675335Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:4c06b67b771dfa4ad353a0bcad3c71e6162d4c201d520c2227dada2e8d57e989","observation_id":"e91a0685-a5d7-4409-8fed-69eed97b46a2","resolution":{"observed_at":"2026-08-06T18:37:14.281905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.259374Z","title":"Missing modality imagination network for emotion recognition with uncertain missing modalities","venue":null,"work_id":"89484b0f-64b4-4f68-9098-196bae5b64ea","year":2021},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.680855Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:a0e6b3dc97aa33c9839da99ef8abd34ac05fa204051b1951e3bccb396ed7ebbb","observation_id":"438d17e5-578e-4684-8783-d4177ebaec3e","resolution":{"observed_at":"2026-08-06T18:37:14.264815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.242847Z","title":"A survey on safe multi-modal learning systems","venue":null,"work_id":"ff7a0041-7370-4b3c-91a1-6b6e706c836f","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.687519Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:9a3109878a7685c47df0ca2a49f987ac8c6692f4afa6d50a477064bc1e6a1c0f","observation_id":"7c16890b-27fe-44c5-8c5e-f0b76d8182ff","resolution":{"observed_at":"2026-08-06T18:37:14.248112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.224947Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":"6739b7e5-6d18-4fde-b582-19131fe9a71d","year":2022},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.694447Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:1c1332c3e7021d87b3574db3fa1e2d24b6a212a172374d9d3898d4460947546f","observation_id":"0700690a-23b0-44fd-8d01-0ff2678c6e70","resolution":{"observed_at":"2026-08-06T18:37:14.231259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.205472Z","title":"Dynamic adapter meets prompt tuning: Parameter-efficient transfer learning for point cloud analysis","venue":null,"work_id":"1d07695a-4c02-45ca-a197-4ac2947c1688","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.701589Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:dd7ef5db98b14ac40beba55153b305bc40883776a18b9dda7324c6207bf6dde6","observation_id":"1c2519d5-65fd-4724-b933-b92b0e244433","resolution":{"observed_at":"2026-08-06T18:37:14.212711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":39},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2507.07802."}