{"as_of":"2026-08-08T21:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:65475ea8acb0b4fef52d2193487094b4aa0e6a0bbf49726aa462326619af28c0","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T17:14:36.026805Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T10:36:52.193683Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:50:10.036846Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2509.00039","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00039","snapshot_observed_at":"2026-07-04T19:50:10.036846Z","title":"Ammkd: Adaptive multimodal multi-teacher distillation for lightweight vision-language models.arXiv preprint arXiv:2509.00039, 2025","venue":null,"work_id":"9a5481cd-2587-42e2-b732-5e5946ecea76","year":2025},"citing_paper":{"arxiv_id":"2605.09253","last_updated":"2026-07-01T02:40:56Z","snapshot_observed_at":"2026-07-06T23:21:21.560069Z","submitted_at":"2026-05-10T01:41:43Z","title":"Cornerstones or Stumbling Blocks? Deciphering the Rock Tokens in On-Policy Distillation","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-30T22:52:01.824412Z"},"links":{"cited_paper":"/paper/2509.00039","citing_paper":"/paper/2605.09253"},"observation_digest":"sha256:812461d8cd0ad4b3654e387f589fbc645da8c13200e22c78aa0f3a4191775ffe","observation_id":"195abef5-7693-4b98-8da7-f30a5c996ef6","resolution":{"observed_at":"2026-07-01T13:45:45.629052Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2509.00039","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00039","snapshot_observed_at":"2026-07-04T19:50:10.036846Z","title":"Ammkd: Adaptive multimodal multi-teacher distillation for lightweight vision-language models.arXiv preprint arXiv:2509.00039, 2025","venue":null,"work_id":"9a5481cd-2587-42e2-b732-5e5946ecea76","year":2025},"citing_paper":{"arxiv_id":"2605.09253","last_updated":"2026-07-01T02:40:56Z","snapshot_observed_at":"2026-07-06T23:21:21.560069Z","submitted_at":"2026-05-10T01:41:43Z","title":"Cornerstones or Stumbling Blocks? Deciphering the Rock Tokens in On-Policy Distillation","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-02T23:34:26.508233Z"},"links":{"cited_paper":"/paper/2509.00039","citing_paper":"/paper/2605.09253"},"observation_digest":"sha256:181ef0ec6aedff32db0f5cb6b2d9e7ed7022212a5fed9aae693ac6f8ebe86f59","observation_id":"06c0836b-7068-442d-8b02-09566db78c77","resolution":{"observed_at":"2026-07-02T23:37:27.066738Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2509.00039","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00039","snapshot_observed_at":"2026-07-04T19:50:10.036846Z","title":"Ammkd: Adaptive multimodal multi-teacher distillation for lightweight vision-language models.arXiv preprint arXiv:2509.00039, 2025","venue":null,"work_id":"9a5481cd-2587-42e2-b732-5e5946ecea76","year":2025},"citing_paper":{"arxiv_id":"2606.00305","last_updated":"2026-06-29T12:51:52Z","snapshot_observed_at":"2026-08-02T00:46:58.308965Z","submitted_at":"2026-05-29T19:32:07Z","title":"Bridging Reasoning Trajectories in On-Policy Distillation via Near-Future Guidance","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-06-28T22:10:00.382359Z"},"links":{"cited_paper":"/paper/2509.00039","citing_paper":"/paper/2606.00305"},"observation_digest":"sha256:7a58013c3a8ad32e3e1d592e86de339aba0b57cbea40f3f373b87330e2257e5b","observation_id":"90a88419-c005-40f0-98e2-5d2c4efc94a9","resolution":{"observed_at":"2026-07-01T19:46:10.101695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2509.00039","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00039","snapshot_observed_at":"2026-07-04T19:50:10.036846Z","title":"Ammkd: Adaptive multimodal multi-teacher distillation for lightweight vision-language models.arXiv preprint arXiv:2509.00039, 2025","venue":null,"work_id":"9a5481cd-2587-42e2-b732-5e5946ecea76","year":2025},"citing_paper":{"arxiv_id":"2606.00305","last_updated":"2026-06-29T12:51:52Z","snapshot_observed_at":"2026-08-02T00:46:58.308965Z","submitted_at":"2026-05-29T19:32:07Z","title":"Bridging Reasoning Trajectories in On-Policy Distillation via Near-Future Guidance","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-06-30T10:34:52.474916Z"},"links":{"cited_paper":"/paper/2509.00039","citing_paper":"/paper/2606.00305"},"observation_digest":"sha256:229d9533a6003702bf3c29790e9cdd0a6bd75f496507a2f3a5cc98c60025ea4d","observation_id":"72536cac-3d96-4550-95ed-6567b7a8dbe3","resolution":{"observed_at":"2026-06-30T10:44:37.263247Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2509.00039","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00039","snapshot_observed_at":"2026-07-04T19:50:10.036846Z","title":"Ammkd: Adaptive multimodal multi-teacher distillation for lightweight vision-language models.arXiv preprint arXiv:2509.00039, 2025","venue":null,"work_id":"9a5481cd-2587-42e2-b732-5e5946ecea76","year":2025},"citing_paper":{"arxiv_id":"2606.22394","last_updated":"2026-07-18T17:41:38Z","snapshot_observed_at":"2026-08-02T10:36:49.390429Z","submitted_at":"2026-06-21T08:49:50Z","title":"Curvature-Adaptive Consistency Flow Matching: Autonomous Trajectory Optimization via Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T10:40:22.767129Z"},"links":{"cited_paper":"/paper/2509.00039","citing_paper":"/paper/2606.22394"},"observation_digest":"sha256:b503d54772c7f02e90a85cf4e31091de07ecbd17d206c8838441c49313fe2567","observation_id":"f36e184e-edcf-4f53-9a64-b464abcc604a","resolution":{"observed_at":"2026-07-04T08:59:42.974911Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00039","snapshot_observed_at":"2026-08-02T10:36:52.193683Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22394","last_updated":"2026-07-18T17:41:38Z","snapshot_observed_at":"2026-08-02T10:36:49.390429Z","submitted_at":"2026-06-21T08:49:50Z","title":"Curvature-Adaptive Consistency Flow Matching: Autonomous Trajectory Optimization via Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T10:36:52.193683Z"},"links":{"cited_paper":"/paper/2509.00039","citing_paper":"/paper/2606.22394"},"observation_digest":"sha256:3ccfaf9ac20584c1edfe41ca9b0a6b3734e53297bcd2d9090f96f6e1c29cad9f","observation_id":"5ad42cec-a607-43d7-8467-5c082b4afc11","resolution":{"observed_at":"2026-08-02T10:36:52.193683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2509.00039","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00039","snapshot_observed_at":"2026-07-04T19:50:10.036846Z","title":"Ammkd: Adaptive multimodal multi-teacher distillation for lightweight vision-language models.arXiv preprint arXiv:2509.00039, 2025","venue":null,"work_id":"9a5481cd-2587-42e2-b732-5e5946ecea76","year":2025},"citing_paper":{"arxiv_id":"2606.25758","last_updated":"2026-06-24T12:32:01Z","snapshot_observed_at":"2026-07-07T00:00:12.737052Z","submitted_at":"2026-06-24T12:32:01Z","title":"Dual Distribution Estimation for Zero-shot Noisy Test-Time Adaptation with VLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-25T21:03:20.583079Z"},"links":{"cited_paper":"/paper/2509.00039","citing_paper":"/paper/2606.25758"},"observation_digest":"sha256:565d46a416d79d6377c69a079409db38a760999b87f91284234baad40a89056e","observation_id":"b1731367-5e7e-4ea4-8b1f-be5e59290dad","resolution":{"observed_at":"2026-07-04T19:50:10.038480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.00039/citation-record","integrity":"/paper/2509.00039/integrity","json":"/paper/2509.00039/citation-record.json","paper":"/paper/2509.00039"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:32.476553Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.476553Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:edf6e8e5f8f30ec612f549454fba0435d621fec983e4ef374d89efeeabe87403","observation_id":"ecf4d217-4123-456d-8dd0-9f6633beee66","resolution":{"observed_at":"2026-08-05T17:14:32.476553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:32.563542Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.563542Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:cc568b803b006fccd7fe2ba4bb3518d428970e038c4502fa20182df1c80daf68","observation_id":"1beb9875-5867-4b8b-9501-7c76760187d2","resolution":{"observed_at":"2026-08-05T17:14:32.563542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:42.968484Z","title":null,"venue":null,"work_id":"48e9c050-dd0c-4f78-b328-e747ee022e69","year":2023},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.611027Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:a825c51620e922a8a18cce006a2cc9baee9bad2da563684ba85111d112275091","observation_id":"2d77f35d-3c7c-452c-af28-83ddfaa45e20","resolution":{"observed_at":"2026-08-05T17:14:43.041382Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:42.757505Z","title":null,"venue":null,"work_id":"d962903f-e66b-46ee-8aef-1f684d42cb81","year":2021},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.697925Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:2a02c69a0fed345a60b8b516207cef84ec17301f866dbf36115af2277e49d8fe","observation_id":"b5f735b7-a8b1-4cac-a53d-c168a9c92ab9","resolution":{"observed_at":"2026-08-05T17:14:42.870520Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:42.513347Z","title":null,"venue":null,"work_id":"e281f69b-c680-49f9-a28e-739b5e283b5a","year":2022},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.773280Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:273efadef2a95a2d0ad6e0f416dd0b8ef30277e41fbd9f34abedecb6f24593e2","observation_id":"727221aa-47f7-44c1-a9b9-3a6215368d14","resolution":{"observed_at":"2026-08-05T17:14:42.634258Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:42.290565Z","title":null,"venue":null,"work_id":"8ec4a71c-b045-46c0-a828-0dddb0d22687","year":2014},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.842987Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:9d95969fa0a785c24e466ac2b3ea79632f0da5013673e2f0ca980c9d9c453ccf","observation_id":"447df630-0d42-453c-9a3e-7f97557443ff","resolution":{"observed_at":"2026-08-05T17:14:42.391801Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:32.891146Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.891146Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:21e904a160e2c9c9e717591a2b3e3a1517fc7c6aaf1f90e9316192b52c72da8b","observation_id":"1184ec61-3fa3-48b6-b2d1-1e5098b55208","resolution":{"observed_at":"2026-08-05T17:14:32.891146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04552","last_updated":"2017-11-29T14:51:40Z","snapshot_observed_at":"2026-07-06T05:55:22.966528Z","submitted_at":"2017-08-15T15:21:53Z","title":"Improved Regularization of Convolutional Neural Networks with Cutout","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04552","snapshot_observed_at":"2026-08-05T17:14:32.949592Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:32.949592Z"},"links":{"cited_paper":"/paper/1708.04552","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:37e0729bb53b1dea2c99827f97a69c125dac3725e3f9bd984d867fe7b90ffd57","observation_id":"13a59f2c-3638-42d0-99eb-9889165e6d54","resolution":{"observed_at":"2026-08-05T17:14:32.949592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T17:14:33.010661Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.010661Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:00e212803dbaeb3941ec49d9140718cf2348b9790a9bbc949de4eb59120b42fb","observation_id":"da79cb77-60b3-4d27-97d1-564d3329dafc","resolution":{"observed_at":"2026-08-05T17:14:33.010661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:42.104546Z","title":null,"venue":null,"work_id":"e662c396-cea2-4e3f-8ea6-68ad73327d89","year":2020},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.061979Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:c4e2cf5e6f522c007cbf27f67e6d4cec8db74a791c7c08faf51b0b6e4664e2c5","observation_id":"809e4ca8-0a4d-40b8-bfbb-6803111dc5be","resolution":{"observed_at":"2026-08-05T17:14:42.168345Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:41.942262Z","title":null,"venue":null,"work_id":"84f291ec-3223-487f-88ec-5576a6516129","year":2022},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.128342Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:7c59e0b9349ca110fb7db4f8d2b6a1ca70f19d3fe4f88c9ea6460272ba23e7be","observation_id":"347660c3-0a6c-4ab5-82bd-fb0301bdd214","resolution":{"observed_at":"2026-08-05T17:14:42.016504Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17425","last_updated":"2023-11-06T02:47:51Z","snapshot_observed_at":"2026-07-06T16:25:38.571377Z","submitted_at":"2023-09-29T17:37:29Z","title":"Data Filtering Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17425","snapshot_observed_at":"2026-08-05T17:14:33.216333Z","title":"M.; Jain, A.; Schmidt, L.; Toshev, A.; and Shankar, V","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.216333Z"},"links":{"cited_paper":"/paper/2309.17425","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:a49d20317862c5792a772181166a9c76b20bc84fe8267576297710cd68ddf1ed","observation_id":"37497b73-f9e9-4edf-bcb0-c57cd4397010","resolution":{"observed_at":"2026-08-05T17:14:33.216333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:41.711677Z","title":null,"venue":null,"work_id":"84a153b5-8a32-46a8-b6bc-272117538929","year":2021},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.268768Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:a749ab09d6233f5761895a1ca6856b77058ca8fb9f10c891970894ab2518de87","observation_id":"585d3206-6b5e-4c04-a418-6a8da617e720","resolution":{"observed_at":"2026-08-05T17:14:41.813180Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:41.263471Z","title":null,"venue":null,"work_id":"55022d65-1663-4e0c-bb2e-ed66a16c7f1c","year":2017},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.322562Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:633bb71f4399ce6ab5326ba729e62aa4c9d310f2e485476ec2275547f37c926a","observation_id":"7ac3277f-0a4b-4039-9f65-b7e161b08fc7","resolution":{"observed_at":"2026-08-05T17:14:41.429706Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:33.422536Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.422536Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:f3ce59238aa3f77afc9fda8f26a6212fda467902ce841de8fa5b6b4d7507a821","observation_id":"1516d860-12c8-46b1-bffd-12ecd9e6c566","resolution":{"observed_at":"2026-08-05T17:14:33.422536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:41.037533Z","title":null,"venue":null,"work_id":"9022a7a9-f3ba-452a-9f25-7dda39d92012","year":2019},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.492049Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:fb36b5ff3166e0ef5b626722599f7577f4f35328119bb5ee70cb69ff023383c0","observation_id":"33b650c4-9296-469c-90c6-a7c98dd0381a","resolution":{"observed_at":"2026-08-05T17:14:41.122913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T17:14:33.534475Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.534475Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:b33bc05d2f4c2caf9e86a0be614a4451f63b0cddd3c03807132c5df12efada2c","observation_id":"be421b27-8478-4f83-aec1-15678ef3b5a9","resolution":{"observed_at":"2026-08-05T17:14:33.534475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:40.755662Z","title":null,"venue":null,"work_id":"fbdc95ac-1c0e-4222-a48c-a937d1286fbe","year":2025},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.647691Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:65a6f516bd03d5486076a447306d0777c925464fcc2b90efa255a89726527194","observation_id":"2cb62e3c-e0b8-4d24-af2b-6e3933d82704","resolution":{"observed_at":"2026-08-05T17:14:40.883523Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T17:14:33.745393Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.745393Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:f963a7c595511f45875d014a7ddfd5da256b2ca29369c172724c88573bf22f34","observation_id":"d237722c-20c3-403a-ac7a-1da6da367d4c","resolution":{"observed_at":"2026-08-05T17:14:33.745393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.07675","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:36.294110Z","title":"B.; Jang, H.; and Hwang, S","venue":null,"work_id":"ac8648ad-be3b-4166-88fb-47efc63264e7","year":2025},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.853514Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:f4c3b8a1c73653c28767c3e1f1c0524177549cd4aa4f2769272cf4e2918e22f0","observation_id":"97850cff-b376-4e85-af93-66604ad7ba62","resolution":{"observed_at":"2026-08-05T17:14:36.408324Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:40.468526Z","title":null,"venue":null,"work_id":"7a10f5c0-4fa1-489d-819f-47f815df8009","year":2020},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.950338Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:71f7487956c4902ceeae345bd1560a5c8f84b1af9074b7202b39321187795fc1","observation_id":"602c16cb-fc30-458b-b909-0f7509607b18","resolution":{"observed_at":"2026-08-05T17:14:40.554043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:40.212891Z","title":null,"venue":null,"work_id":"76104045-0303-4a7e-b63e-9942e0fe2638","year":2025},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.044469Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:2f33a31f4871909cb022bffaf537138a4030fdb883206ee654d0fe390bd54d69","observation_id":"39e2ab10-2edb-4c21-ab59-3be286c850af","resolution":{"observed_at":"2026-08-05T17:14:40.354013Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:39.957471Z","title":null,"venue":null,"work_id":"1456d5b9-a608-434f-99e6-58fb2c4f8955","year":2023},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.139320Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:95728498dd593efce1960f82ac31e2393309fd2bed501c0e5861f1ad52c45a9c","observation_id":"49229b96-2508-4fe3-a322-cb893978c0d4","resolution":{"observed_at":"2026-08-05T17:14:40.118387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:39.804846Z","title":null,"venue":null,"work_id":"1d68efb0-a34a-49ff-9e19-2b01ee50e1c5","year":2021},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.240302Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:b085664cfd080991d51c6d72f1c0433eff35d703f8a9843673a1a8332f530cd7","observation_id":"507df20b-4ac1-4265-9be3-e279ee7f251a","resolution":{"observed_at":"2026-08-05T17:14:39.861888Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:39.616870Z","title":null,"venue":null,"work_id":"9581b5a2-7d68-402a-92cc-60ac5ad7fafb","year":2024},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.328696Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:a89dddced0ff9c2480386a5bf9eb56b9cbeb71c21b3c4929f8cc2bb9600744a4","observation_id":"cc944aef-79f3-4532-b6a5-b4ea7249696d","resolution":{"observed_at":"2026-08-05T17:14:39.701346Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:39.345968Z","title":null,"venue":null,"work_id":"703176ef-fd92-4522-96eb-52c9703b0c78","year":2020},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.407987Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:553e2d68ec06bcef6e6b1e29eccc301a01fceae0a57674b34ca788a8c5245c3f","observation_id":"a051ce1b-6b00-4a55-b2b1-60d1a37087b9","resolution":{"observed_at":"2026-08-05T17:14:39.514023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:39.114539Z","title":null,"venue":null,"work_id":"b33151fa-0624-449f-a075-fc1280c270ad","year":2019},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.505874Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:17066abd79268324b8d55e0a72fd681df2e2c325feb176e14f287b6d2d9c3788","observation_id":"546f1203-5019-4a7c-81a3-0e336e716a05","resolution":{"observed_at":"2026-08-05T17:14:39.193555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:39.006973Z","title":"M.; Vedaldi, A.; Zisserman, A.; and Jawahar, C","venue":null,"work_id":"b343b4cb-2205-4960-a04c-3a73c3eb059d","year":2012},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.554033Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:511baa38551abf2323397544e0ed090ba5e526886db75c8874704f95f292bb2f","observation_id":"b9071d40-059f-44be-81c3-e5754617c9a6","resolution":{"observed_at":"2026-08-05T17:14:39.078737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.911784Z","title":null,"venue":null,"work_id":"51e8a296-55f0-40f1-a905-248ced41caaf","year":2017},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.614373Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:7b42449d7d8fbbde0721b9226eb014842015b39ef8ffae2c9306f3c78294598b","observation_id":"29e9dc4b-bf00-4b6a-868c-56a5d58dd713","resolution":{"observed_at":"2026-08-05T17:14:38.963470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:34.683157Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.683157Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:0e7b99898896a4c193e628a6125765e079266570a4e954932cef424476c20e03","observation_id":"68c569a1-4b58-4cf5-8be4-14d1ae1dc789","resolution":{"observed_at":"2026-08-05T17:14:34.683157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6550","last_updated":"2015-03-27T11:52:28Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-19T22:40:51Z","title":"FitNets: Hints for Thin Deep Nets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6550","snapshot_observed_at":"2026-08-05T17:14:34.760216Z","title":"E.; Chassang, A.; Gatta, C.; and Bengio, Y","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.760216Z"},"links":{"cited_paper":"/paper/1412.6550","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:7eca2583f892837b5e1088f197c4e723d1d81467ad9a0b8228cd99bb99cea2e3","observation_id":"71c2cf7b-7168-43ea-b6f0-4419c6dc8591","resolution":{"observed_at":"2026-08-05T17:14:34.760216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.739770Z","title":null,"venue":null,"work_id":"84c22f5e-3cf3-4e46-a462-e23a70af992b","year":2023},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.795680Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:d5f6b7e2c3a4509e986f7a4d940cbe71e0b599cf8d66611c7022bd8a131caa8d","observation_id":"a6d5067c-ec1f-4170-86cd-84f3191d8f8c","resolution":{"observed_at":"2026-08-05T17:14:38.818815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-05T17:14:34.867560Z","title":"R.; and Shah, M","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.867560Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:93ac1af6d9e3e15f477cce7c273629dc0e5eb974482b08f98c2de5af6f7ec2a4","observation_id":"561e87ec-5ba1-4bdb-ae7e-9cdc8972db5d","resolution":{"observed_at":"2026-08-05T17:14:34.867560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.609775Z","title":null,"venue":null,"work_id":"407484c2-859b-4e83-97ab-a94111177601","year":2024},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:34.931509Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:bc34f2c959c175fbde3d37178ae16d9b951a128dfa0fd28f8274597ae5cbcb58","observation_id":"3054dde8-f780-4431-99f2-a267ad116c07","resolution":{"observed_at":"2026-08-05T17:14:38.672171Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.522311Z","title":null,"venue":null,"work_id":"b3f04d78-ed72-4c9a-b649-ccc71fc121ef","year":2019},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.018122Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:e2e7704b5434c416265a1366c0fb80f56afa86a7ff7aca1e7f2575a671f9948a","observation_id":"c933c95b-bf7d-4833-b897-ec47882b32c1","resolution":{"observed_at":"2026-08-05T17:14:38.557094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.416674Z","title":null,"venue":null,"work_id":"4fc4fd29-453f-44c5-99e7-3a46c95035ba","year":2022},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.080441Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:bf17a9f0b61edf126f6d2fab00d3a3878bfc44df3f99006812a2f1266d379fc9","observation_id":"cfb82c9f-831e-4470-84f3-9f440a26e1a4","resolution":{"observed_at":"2026-08-05T17:14:38.470895Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.313481Z","title":null,"venue":null,"work_id":"459da1df-234d-4729-b6db-13b38d5eff07","year":2018},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.109323Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:005fdc05e8f22b9ad88bd4326528345e36f486c863c40bedbba1ac72692a33a2","observation_id":"d02780b6-d9c8-4d7f-b63a-0f13d9ec64fd","resolution":{"observed_at":"2026-08-05T17:14:38.364951Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.10496","last_updated":"2022-04-28T17:43:36Z","snapshot_observed_at":"2026-07-06T13:02:42.093125Z","submitted_at":"2022-04-22T04:41:04Z","title":"Multimodal Adaptive Distillation for Leveraging Unimodal Encoders for Vision-Language Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.10496","snapshot_observed_at":"2026-08-05T17:14:35.170744Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.170744Z"},"links":{"cited_paper":"/paper/2204.10496","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:ee322b584bf55a999d194a1ebf201caea8a6feaa93f4ce77d50f168a47091f51","observation_id":"2c72dd15-3912-4388-ab23-7e1f15ffb57a","resolution":{"observed_at":"2026-08-05T17:14:35.170744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.190404Z","title":"S.; Wang, X.; et al","venue":null,"work_id":"6df946b8-5e8a-414f-b6f5-80602dbb3b73","year":2023},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.251931Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:780da0d6010ffcdcdaef02760b0355417446f794a29ebf94bfc356aa092bf7a7","observation_id":"458552f1-7d10-4339-835a-8327ccd2204d","resolution":{"observed_at":"2026-08-05T17:14:38.232574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:38.060737Z","title":null,"venue":null,"work_id":"49c87ef5-e42d-4a38-9f86-6650f8f8be05","year":2019},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.326509Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:b459f5ac7b703e0e47591e655d838a0f588026873f81e7268e4488c82da1656d","observation_id":"a9b742ea-b15d-4bc9-b577-b354ea71b5b6","resolution":{"observed_at":"2026-08-05T17:14:38.120462Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:37.948694Z","title":null,"venue":null,"work_id":"c416b17a-1a3e-40ba-9231-e4e05d8457da","year":2020},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.396490Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:60fad76fd8fa9b87110335cb52246999e5f969f084f10f861b0b5e57ca1a8252","observation_id":"c7e296e6-6dd6-4f66-80f2-e7c3471b199b","resolution":{"observed_at":"2026-08-05T17:14:37.979565Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-02T17:17:56.296462Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-05T17:14:35.426238Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.426238Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:b1ff2621666262a5f225fb5971299cfe8535878969f2dc7c84a6e735745e5af6","observation_id":"c9df8fc1-3cb3-4dd6-9ea5-56d2eb4caa54","resolution":{"observed_at":"2026-08-05T17:14:35.426238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:37.825924Z","title":null,"venue":null,"work_id":"6ad59cfb-c213-4e63-bea0-73af5f2b92da","year":2024},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.476516Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:8afd2e3267729954f2f2265cedb8cb5af4dac89d01fd78dec10b20bddbadad4c","observation_id":"63e666b7-8336-4895-8673-a87533e6a8c2","resolution":{"observed_at":"2026-08-05T17:14:37.872632Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:37.677683Z","title":null,"venue":null,"work_id":"eb359556-c24e-486d-b6d9-721ae9feb702","year":2022},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.564905Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:535aadd7b9182f3f4f504a2d205e9a233e2f5ec5485b814bea41ec1018ce1660","observation_id":"dc2b557e-5b86-49fe-9ff5-8c346e752010","resolution":{"observed_at":"2026-08-05T17:14:37.755942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:37.453091Z","title":null,"venue":null,"work_id":"aa757358-1a6a-4486-8086-d807b4d1fcf8","year":2017},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.627803Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:784aa8fee309174dfb0138e22ab4550920517874b5e91326c8562b2f5c0fbbdc","observation_id":"528f9768-6ae8-4c8d-b956-8d65b94e6c81","resolution":{"observed_at":"2026-08-05T17:14:37.545512Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:37.275477Z","title":null,"venue":null,"work_id":"6992c737-4d1e-4c46-a17e-3553542cfe93","year":2021},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.713718Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:0d36ed8cd7d1929bd078f81220fc85a786113724fb9d9b6e954dea69cf89157e","observation_id":"69df6b77-0b1c-4171-a981-a772f91c5605","resolution":{"observed_at":"2026-08-05T17:14:37.318867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:37.117342Z","title":null,"venue":null,"work_id":"15f215a6-bb65-4c4e-b909-a5707a3e97cb","year":2022},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.757257Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:aeb8aa420b9f8bfda2c8be56c042f75a99832107f71addbc1ea0e7a9532a7040","observation_id":"9603b6b4-77f4-4619-ac81-67628d51d4a5","resolution":{"observed_at":"2026-08-05T17:14:37.167515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:36.933665Z","title":null,"venue":null,"work_id":"b9e4705a-dc13-4ce5-8f2e-ef9130614069","year":2023},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.806693Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:b823847f0b226e308788af6944c0a689557a35941efe287f1a4cc487e7414c08","observation_id":"db73879b-b075-43f7-83d4-4827f105dc55","resolution":{"observed_at":"2026-08-05T17:14:37.029888Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-08-08T10:28:19.597631Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-05T17:14:35.899461Z","title":"N.; and Lopez-Paz, D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.899461Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:4088063f575ff051b2279f41386abfbdb5652de39c594e392fba8d81fa47a9c3","observation_id":"3cba4f76-9c4a-49a8-9770-d18a92b36b57","resolution":{"observed_at":"2026-08-05T17:14:35.899461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:36.784409Z","title":null,"venue":null,"work_id":"8043cc2b-4c1f-4515-9a6a-ca068b734402","year":2022},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:35.948619Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:cdda11c0a1c4a3f777a99cbd68f1e1856bef65b560fc66a5126d81c571ff1484","observation_id":"fb449c02-21f5-4c95-8e0e-d91346fb0ffd","resolution":{"observed_at":"2026-08-05T17:14:36.874015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:14:36.661210Z","title":null,"venue":null,"work_id":"4f2e41d4-bdad-48f3-a805-fb303d993361","year":2024},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:36.026805Z"},"links":{"citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:26f7e5c3e131d8b510cd2e89d25d20683ea564a23c074672242ed9a646b48d1d","observation_id":"fdaff4be-467f-4ef6-93e2-ad1eb90d52fe","resolution":{"observed_at":"2026-08-05T17:14:36.727202Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 7 inbound Pith citation observations for arXiv:2509.00039."}