{"as_of":"2026-08-07T18:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d4f7a8726fda124f7095c0de7f12fb9bd8fd593ad18602231d67ddbe34478460","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:47:50.404759Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.12724/citation-record","integrity":"/paper/2506.12724/integrity","json":"/paper/2506.12724/citation-record.json","paper":"/paper/2506.12724"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-07T00:47:50.338627Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models.arXiv preprint arXiv:2301.12597, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.338627Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:681b8de05a174805f064a2c68a87b765174c02d1f182c5417e13a779592d4765","observation_id":"b0963f86-4b0f-4522-ab6f-31c2a357a002","resolution":{"observed_at":"2026-08-07T00:47:50.338627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.14198","last_updated":"2022-11-15T23:07:37Z","snapshot_observed_at":"2026-07-06T13:05:12.350238Z","submitted_at":"2022-04-29T16:29:01Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14198","snapshot_observed_at":"2026-08-07T00:47:50.343150Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.343150Z"},"links":{"cited_paper":"/paper/2204.14198","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:100533a62fc3d135c6b7ee24b81c3245e2a7aac71d357676413d0c769dec1713","observation_id":"63157067-04a8-4578-be86-a399723a710e","resolution":{"observed_at":"2026-08-07T00:47:50.343150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12995","last_updated":"2023-04-25T17:05:38Z","snapshot_observed_at":"2026-08-04T09:21:35.342211Z","submitted_at":"2023-04-25T17:05:38Z","title":"AudioGPT: Understanding and Generating Speech, Music, Sound, and Talking Head","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12995","snapshot_observed_at":"2026-08-07T00:47:50.347136Z","title":"Pali: A jointly-scaled multilingual language-image model.arXiv preprint arXiv:2304.12995,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.347136Z"},"links":{"cited_paper":"/paper/2304.12995","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:b68eb60d87b685d7fe39e1b340e4850c384e10efa586fc83b440c6db42c8e9e4","observation_id":"8df1b59a-afa1-4117-8617-be392739b705","resolution":{"observed_at":"2026-08-07T00:47:50.347136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T00:47:50.351305Z","title":"Visual instruction tuning.arXiv preprint arXiv:2304.08485, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.351305Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:13502bfdbc6133ad9a75de49ce1620a792d893b17ef1073facdcf90298400fab","observation_id":"8cf80597-a52a-49c0-92c0-165faf9c3c61","resolution":{"observed_at":"2026-08-07T00:47:50.351305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.630195Z","title":"Learning transferable visual models from natural language supervision.ICML,","venue":null,"work_id":"27a874a9-f41c-4c66-9aa7-3fe131703602","year":null},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.355500Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:7c87b8e6d992cad27e8438a66d7ae6474e2bc3d1c5047201101b3dc01179e1ae","observation_id":"22a76260-dacd-4907-ab51-7bd2e730cf46","resolution":{"observed_at":"2026-08-07T00:47:50.634602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.08533","last_updated":"2022-06-13T14:16:14Z","snapshot_observed_at":"2026-07-06T10:34:19.340163Z","submitted_at":"2021-01-21T10:33:02Z","title":"Eliminate Deviation with Deviation for Data Augmentation and a General Multi-modal Data Learning Method","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.08533","snapshot_observed_at":"2026-08-07T00:47:50.362206Z","title":"Elimi- nate deviation with deviation for data augmentation and a general multi-modal data learning method.arXiv preprint arXiv:2101.08533, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.362206Z"},"links":{"cited_paper":"/paper/2101.08533","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:91838a0c431736f540afa05e612565f51b54e0045315bff9606c14f08c943d8d","observation_id":"2a59e8b0-f24f-41d5-bd05-2840cc8bee1f","resolution":{"observed_at":"2026-08-07T00:47:50.362206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.618977Z","title":"Beyond dropout: Robust convolutional neural networks based on local feature masking","venue":null,"work_id":"6a079218-6b06-4908-93fb-b937c98c4641","year":2024},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.366641Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:b18246c169ff229800d4a6d05a2dc9ec53c40264cf5324ca04591841170d5bcf","observation_id":"ed8536f1-1788-4ea7-ad09-fcb407202a97","resolution":{"observed_at":"2026-08-07T00:47:50.623042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02431","last_updated":"2024-09-04T04:18:25Z","snapshot_observed_at":"2026-07-06T19:10:12.721500Z","submitted_at":"2024-09-04T04:18:25Z","title":"Adversarial Learning for Neural PDE Solvers with Sparse Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02431","snapshot_observed_at":"2026-08-07T00:47:50.370161Z","title":"Adversarial learning for neural pde solvers with sparse data.arXiv preprint arXiv:2409.02431, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.370161Z"},"links":{"cited_paper":"/paper/2409.02431","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:6475e93af20b35830e7806bc3ccbed33dc6f0909c5c6060067762057b42183d8","observation_id":"6079d342-f93b-4f91-92a1-61c2daa5b5fd","resolution":{"observed_at":"2026-08-07T00:47:50.370161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.607702Z","title":"Cross-modality perturbation synergy attack for person re-identification","venue":null,"work_id":"b97b7f33-e90e-46ba-a69c-cd650b5fc871","year":2024},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.374112Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:2d4066519a572503eff77db4e7ef7d20f1c044fee2e94728f36355cfea20048f","observation_id":"63d7a74c-6298-4dd6-b5de-b9284b4c3f49","resolution":{"observed_at":"2026-08-07T00:47:50.611560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.594924Z","title":"Person re- identification method based on color attack and joint de- fence","venue":null,"work_id":"7ddaa4ca-7d3b-4b96-ae78-9db8a7821973","year":null},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.377269Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:1ff11491f73874c59daa9e073addd115c98672a80a87934b5b9406b39d1134cc","observation_id":"a3b4d717-b914-4da7-ac5f-9c12c7eae8c6","resolution":{"observed_at":"2026-08-07T00:47:50.598727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10512","last_updated":"2024-01-19T06:04:48Z","snapshot_observed_at":"2026-07-06T17:17:44.177514Z","submitted_at":"2024-01-19T06:04:48Z","title":"Exploring Color Invariance through Image-Level Ensemble Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10512","snapshot_observed_at":"2026-08-07T00:47:50.380630Z","title":"Ex- ploring color invariance through image-level ensemble learn- ing.arXiv preprint arXiv:2401.10512, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.380630Z"},"links":{"cited_paper":"/paper/2401.10512","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:8d32db68b049e526fe867f09f11b5878b55f0019473e0f0cf43557a3ae5ab10d","observation_id":"2fcab2e8-ab84-403d-a4aa-6467d3bd12f1","resolution":{"observed_at":"2026-08-07T00:47:50.380630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T00:47:50.384237Z","title":"Gemini: A family of highly capable mul- timodal models.arXiv preprint arXiv:2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.384237Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:8a4b67b3c7be79bf2cad8c1c864e540ff11ccd9f797cee7b41470b2c6b323eaf","observation_id":"d56c0bef-0640-4c1f-bead-306941044f4e","resolution":{"observed_at":"2026-08-07T00:47:50.384237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.582679Z","title":"Vilbert: Pretraining task-agnostic visiolinguistic representations for vision-and-language tasks","venue":null,"work_id":"8d67a164-69e0-49b3-8e96-5bf7eeeb5a8b","year":2019},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.388037Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:b8258758d1dcf59cc9a427fc843c8c34b4bc160d3cab3771e55f5f832aa6a3da","observation_id":"a5ac239a-117d-4270-9e4d-9f27014e63a2","resolution":{"observed_at":"2026-08-07T00:47:50.587063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.571297Z","title":"Beyond augmentation: Empowering model robustness under extreme capture environments","venue":null,"work_id":"38bfda15-10e8-4929-abe3-e118f95fa8c0","year":2024},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.391228Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:4e46ce74af748f754502b8ee2378980411c22fad64226f2465c112dc787bb48b","observation_id":"7d61dd35-6492-489b-87f5-e39c460889b4","resolution":{"observed_at":"2026-08-07T00:47:50.575020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.561092Z","title":"Dropout as a bayesian approximation: Representing model uncertainty in deep learning.ICML, 2016","venue":null,"work_id":"9fa9d428-4ea6-4579-bc55-9ac09aa287e8","year":2016},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.394484Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:2284a3e8b677047a32e14a429e6c20b22b2e0276f96ccdc83a74d617335addfb","observation_id":"aeb203be-5b92-4b0d-adf6-6b8b06c9f952","resolution":{"observed_at":"2026-08-07T00:47:50.564612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17977","last_updated":"2024-09-26T15:52:34Z","snapshot_observed_at":"2026-08-03T15:23:25.760282Z","submitted_at":"2024-09-26T15:52:34Z","title":"Cross-Modality Attack Boosted by Gradient-Evolutionary Multiform Optimization","version":1},"cited_work":{"arxiv_id":"2409.17977","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.17977","snapshot_observed_at":"2026-08-07T00:47:50.448751Z","title":"Cross-Modality Attack Boosted by Gradient-Evolutionary Multiform Optimization","venue":"cs.CV","work_id":"8df5f66f-5df3-4a8e-a4fe-873bf9b254a8","year":2024},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.397605Z"},"links":{"cited_paper":"/paper/2409.17977","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:33ce92ba7c3e7ebc5ed5bab3d6e98d1e8b7473ca7fdf03839c4fc739b48a0fb1","observation_id":"581db55a-9485-42fb-879b-bb5d41098147","resolution":{"observed_at":"2026-08-07T00:47:50.454735Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:47:50.551204Z","title":"Gshard: Scaling giant models with conditional computation and automatic shard- ing","venue":null,"work_id":"a32dc799-2182-4f7c-b3e9-8cd067e9556e","year":2020},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.401341Z"},"links":{"citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:ebb903f441e94b94e0627cab02ad15177aee71363c01485ec645e738d67372ba","observation_id":"17e635bc-41fa-40bc-b221-7dd05fda1496","resolution":{"observed_at":"2026-08-07T00:47:50.554704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07783","last_updated":"2021-11-09T17:15:38Z","snapshot_observed_at":"2026-07-06T12:08:35.761426Z","submitted_at":"2021-11-09T17:15:38Z","title":"FILIP: Fine-grained Interactive Language-Image Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07783","snapshot_observed_at":"2026-08-07T00:47:50.404759Z","title":"M3ae: Multi-modal model pre- training with masked autoencoders","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:47:50.404759Z"},"links":{"cited_paper":"/paper/2111.07783","citing_paper":"/paper/2506.12724"},"observation_digest":"sha256:0b6a3ac65b4e6f0e46e6a2ee68fe1d079b50fd3bb843973749049dfd273f4703","observation_id":"8b568bdd-c956-4ff0-8550-f4dff723ec8e","resolution":{"observed_at":"2026-08-07T00:47:50.404759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12724","last_updated":"2025-06-15T05:15:52Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T00:41:20.866557Z","submitted_at":"2025-06-15T05:15:52Z","title":"Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2506.12724."}