{"as_of":"2026-08-16T16:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:54068d628c743f4cbab8cfd6c9e951852dc74e257e45f6e8841136c0e8c3bc5f","coverage":[{"denominator":73,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":73,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T11:19:42.981402Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.27967/citation-record","integrity":"/paper/2605.27967/integrity","json":"/paper/2605.27967/citation-record.json","paper":"/paper/2605.27967"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:fb6b72d3905418096e5489e8a9b6c6a749b572e967f3dea33192276092ad0a0b","observation_id":"c56e306f-9002-46b9-abd3-25deec6d5402","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:7bfd9d6e80271233b306640e6ad0462b6a1e6a9bb5010d721461191c026ed4b0","observation_id":"853470c2-3ecf-4f47-8c0e-7d46351bd4e5","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:2d782a87a63f17144384eed7dacf50ef4f4ac5c4ffbaa05d0df1ff5517685d5d","observation_id":"0c32ceb1-bb01-4514-885e-fab477cf96e5","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Cornebise, K","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:9a58d0b207a19f9426fe4a56c73783e082ea61541fcee2b3e5e6799d37a0c57e","observation_id":"f78d2e24-7ad8-413d-9df2-f934fe17e206","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:6d6b198adfedb24bda6ef91d0f4b51e6045a08dcf80212e9fcfa4eff58055446","observation_id":"3332f7ec-8c41-46ae-b92f-d3737054c638","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:3203c7b40760c4668bce1cd9f2af5cbe3c017b004479de2719c0fe3b21fff287","observation_id":"29d58a73-c382-4da1-bc36-4cf43d5585ba","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:f7a5e4768d00d90e66bcf15a3278e1097cf99b24b3076a60dc597e9b0a8f95b5","observation_id":"d4ceb69b-5f20-47c3-8a79-6829a1e82e40","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:bab48ae93e8ae4930d881312f0f7c5077d4274d6fba72eaae5bed4ec868a55ba","observation_id":"91706e0e-b2a0-4c6d-ae61-895b505de690","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":"2010.11929","doi":"10.1175/jcli-d-22-0357.1","metadata_source":"pith","pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","venue":"cs.CV","work_id":"e96730e3-129b-4db6-b981-15ab7932e297","year":2020},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:c0519dd15e11b5682e25339969a52e16b0af76eb7bf03b31df8ffdcf1cdaea3c","observation_id":"47929755-0e42-4a2b-b3d0-9362cbfb72aa","resolution":{"observed_at":"2026-06-29T11:23:20.834131Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Ma and Y","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:e1dc21cb7345da678005141b2d8a8c8bec4ab428d93e882dca9d81ce4dc85fd3","observation_id":"fde54e12-99ab-4f63-b475-303cfe59cfa0","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:58e4cac2c9af9b206167bfa7186e6e50bd77b5e77f5dc01ca235312aaffef648","observation_id":"93150caa-34fc-412e-bcb4-5544f532e93f","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:dff249083999a3938259f41c5fbffa3c327875d3b0fe0eb32ee999bd20fe5e0f","observation_id":"3bc0c44e-8fdc-4dfd-8a6d-963f652fd7c8","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Suzuki, G","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:83b4575ea07171fa218e05ecb3d65938a61bb6341dbd73f9f7789c1a1e616a37","observation_id":"4ae5d253-c984-43fa-9fa8-ffbe7e4d4194","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:cc30248dd5400d9b056c4d1e2601bfc08231ee828395832bf1e8f29ee6c4e2f5","observation_id":"35c0b5e6-865d-4fd8-a5a4-803ffbd62643","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:ccf26caa39094fadab3ebbfd3754d1ffda0a0622ab19615f8a4b22d873a42d81","observation_id":"93ae7fcb-b6dc-418e-ad18-00fe6fe2baed","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:9d8dbfe3e9599d35892211944142af75159529f5efa22f8b54f32e8311e32988","observation_id":"1b5437a6-fef7-46f4-9c04-4d3219990f1d","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:c7595a9cd9549bd0d112622da3137cf217cd74f2466ce927a7d2c8bd19be6f97","observation_id":"00769d53-04a4-4159-b72d-7e42e96e4052","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:80076a3842e50edb09a5860e5584feafa68a8f917d9ee31dbabea78af6bb5f3e","observation_id":"0662356a-7b56-49bb-8522-33beae8ba75a","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:1e097861b3c750491a29797b6105a9442d4ecb1916a30204656de8fbd7486952","observation_id":"488dcf92-e420-48c2-9700-40f397df46f0","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Bengio and A","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:1d67ffb21092c9f49ccce4f2ea276532adc76515d8534948d0a547af88b1eec2","observation_id":"4e7f4648-230b-4289-a63d-3730070c03b3","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:60267b6b57b511c9df387c594b9de5df41907c9db18de6dc3375c9cd0c11695c","observation_id":"4c716e8b-8c80-4fd3-9137-e25fd266fc96","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:bcc4d2b0d3b1aa0e9988d0e6c0b25989728fd017c8072b2266ba9523149d23b2","observation_id":"6d14305b-6f27-4076-824f-8cfa169788db","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Kohler, A","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:376ef0a2c15493e7ce9885a37a381823376df714e15753774f21902a4f23c006","observation_id":"eb9304fc-0f8e-4952-8c50-c10a54c98d92","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Zhou and X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:13af318362b868355b6731de2ce851ae78137f49f515cdb7cbc60eba0cd46744","observation_id":"c8d3fd8c-f2e8-472d-ad74-d3d53830df45","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-14T22:57:08.956233Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":"1503.02531","doi":"10.1109/cvpr52733.2024.01515","metadata_source":"pith","pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distilling the Knowledge in a Neural Network","venue":"stat.ML","work_id":"d927ab1f-17b8-4002-9d09-c3d55764fbad","year":2015},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:b87a10a7d7778da698547f9ee55ae7c75c155c851385eea4c31e9228092e3217","observation_id":"576b8bb3-9e8a-4308-bd15-3efbf28e5767","resolution":{"observed_at":"2026-06-29T11:23:20.842341Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:dda7b54eb58a663c43b529f2c310e0703b6d8ecf812eac7181a3c40c40287b96","observation_id":"b15e4070-fc82-4274-ab06-8adbd99e348c","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Stein, D","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:c931083e9eb950d2f5bc69ab5f555fc5a71545dc7dbd84ed03b852f776d2fef8","observation_id":"a3f8e6d9-d427-49e0-a29f-de23f70dfccb","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:408f1c693fee9c11aecdd852e7721956f8de794a000cd165d70dbfbedafa993b","observation_id":"48460222-4987-47c8-9f5a-d8522201bcc4","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"G., M.-H","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:4adfbc8bdd6b1295db6f9937e856dc0309dc9f6200cf3eef36acf715a34a0ea7","observation_id":"6e23caa7-d087-4b4f-a547-07252ace6da5","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14125","last_updated":"2024-06-04T17:25:20Z","snapshot_observed_at":"2026-08-14T12:12:01.418974Z","submitted_at":"2023-12-21T18:46:41Z","title":"VideoPoet: A Large Language Model for Zero-Shot Video Generation","version":4},"cited_work":{"arxiv_id":"2312.14125","doi":"10.48550/arxiv.2312.14125","metadata_source":"pith","pith_arxiv_id":"2312.14125","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoPoet: A Large Language Model for Zero-Shot Video Generation","venue":"cs.CV","work_id":"5cc3572d-7e2f-4431-ae42-d9282a42a800","year":2023},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"cited_paper":"/paper/2312.14125","citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:6840d3647360022874c0b3a913ab0cd3a3689148b463c4a75e59253ab9b91e88","observation_id":"49f6aea2-8df3-45e8-ae61-fa2345974d7a","resolution":{"observed_at":"2026-06-29T11:23:20.852373Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-05-23T03:24:43.956758+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T03:24:43.956758+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Rathod, K","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:a8f9b1a390a7839e167aa01032bf0a0c0b0628ea98478cf20863c4f372875817","observation_id":"f203126a-d966-4526-ad5c-3f60fb3bb074","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15842","last_updated":"2024-06-11T18:01:09Z","snapshot_observed_at":"2026-08-16T14:31:41.330335Z","submitted_at":"2023-12-26T01:24:25Z","title":"Knowledge Distillation of LLM for Automatic Scoring of Science Education Assessments","version":3},"cited_work":{"arxiv_id":"2312.15842","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.15842","snapshot_observed_at":"2026-07-04T16:39:57.724585Z","title":"& Zhai, X","venue":null,"work_id":"67ba5dfd-98e6-4af5-9d89-898295ee6915","year":2024},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"cited_paper":"/paper/2312.15842","citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:17322b94ca09494c0a9eef2a9a67274e07b6acd75c651a1049c48c1bda9aecbc","observation_id":"f493c9e9-d39d-47d2-a2fe-b3245c1bf491","resolution":{"observed_at":"2026-06-29T11:23:20.844878Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:a25103c6bd5f9d432dbdb0ce5dafd0059e9025c217bbf03bb493f4e73f43051d","observation_id":"40c152f2-da01-4756-bafe-8215b17b9b2e","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Zhang and J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:eecb4f19b0d39d5d6f4fcb299cb4b1d69010ff94a3b3b755ef7a5be24d8a3683","observation_id":"9ceb71ef-b1ab-488b-a6fe-36b7fc4d372c","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:50378435a60d956feedcef4f4cf225a383c33fb535d31a2f325307936d2fa05f","observation_id":"abf1ba02-5117-4984-973a-7b4531384a28","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00076","last_updated":"2019-11-25T21:27:46Z","snapshot_observed_at":"2026-08-14T16:39:05.935182Z","submitted_at":"2019-04-30T19:46:28Z","title":"Ensemble Distribution Distillation","version":3},"cited_work":{"arxiv_id":"1905.00076","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1905.00076","snapshot_observed_at":"2026-06-29T23:14:02.022642Z","title":"Ensemble distribution distillation","venue":null,"work_id":"724a7669-7398-4e27-9fa1-5e7bb37dab5e","year":2020},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"cited_paper":"/paper/1905.00076","citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:531dfdfcd4312de7fa64f1c022a6148ad8a3849c40ca663a547023c2c265b7d4","observation_id":"17f3bdf2-7b0b-4a70-ab51-d4d2b4f99fc4","resolution":{"observed_at":"2026-06-29T11:23:20.850145Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:8dbfda85f8898c22a65add711a5fccddaecdb14b89df79cf48145f71a1dd1454","observation_id":"8e609041-6b5e-4477-ba8b-22911990d8eb","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:864ee6112a9f615a7bbc4cf262d0556dc3556ceaaf42b333f361e521e3c615e1","observation_id":"ed80c9c3-745e-4596-bf8a-2f483cf7530f","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Nezafat, M","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:a15cbdeb61079fb530c770593f96cc0db6f29d1c3b3399c428e8bd1977da1271","observation_id":"64134b08-7aaf-486c-ae2d-c1d3734f7477","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:8a779c3cb93084474713288bd3fcceaf4cd066f6bbf086320a606082e52ff0cf","observation_id":"d8f1ba6d-6ae4-48f5-8609-0ef160d5bba9","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:dca42b38079e34aa6341bcabe867b7ebe3638b6aed6abc96190f1601c14d4f47","observation_id":"f16f6e1a-b0ed-4cb7-9445-b32e8e12b5ef","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"(2023, May)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:89526bbeb372f9d4d7db8d49eb4ed93c7c1b89dd331a5b3091078dcc22bb8ad6","observation_id":"2419c235-7e02-44d4-9b67-93fb0619ccf5","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:3c8dc244b809e4cf209bc6766686b10dbcadf9e0aada537c59d9d0136d901455","observation_id":"b59dd830-e616-4056-aa46-8617b81eab71","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Kerssen, M","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:e37d2f93d6a97f764cd0b491908596c06bcb575af7db60fd286296f3053a419c","observation_id":"6135c3d6-e34f-4b5d-ae8c-19a04fd3a1f9","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:a88cc6d1360f188694839b89962ecf39d10b2b63b9b644741fb2b3726174891d","observation_id":"38015de3-f44d-4c5c-be38-23c7192c2e0e","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:fa23eab060ac592524c6ce08fc90eda555a2818101b2e61d37df01d5e82ea472","observation_id":"f50786fd-02bc-45ad-ac8e-37ae1e937bbf","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:dd645b23e0c4669c89bc6bc82564d9cdea5a972154356a63ae562c51424e742e","observation_id":"691eaa5b-03eb-4939-b75d-86356a959aef","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:f04b27cb6b0c21b1d4cbe426a8c2de28d56dd0ff303922039fa681d32beab229","observation_id":"57bafa87-9c2b-4be9-9696-d93fb16f095a","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:1330ed1fb302e288ef2287966f56c8dac33c88bf178364b5d33753dac7d158e6","observation_id":"65cdb338-0b73-46bd-8f25-080d0826a383","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:f8fedb762e6410dc4408953b7da38b3c384246984d89b1ab3cc514631baeb9b8","observation_id":"590c1d1a-ca60-4730-8667-38d409f4030b","resolution":{"observed_at":"2026-06-29T11:23:20.850169Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:b11af29159354a182c6c8276478c94326d31690b49839aa84c9ecf14ecb24cb8","observation_id":"29480961-6c20-44bd-adeb-2e665914100c","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Jalaian and B","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:28aaa150787cc829952cd8bc9dd056e2ef527a4cae8e481ad43816d0c65cd833","observation_id":"0f9e491e-eda6-4df6-9f4c-580779942644","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Vicol, J","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:e3ec5979269a79d604d31d422caa5bdc7d66eabd451b143924c85b6cb2fb87dd","observation_id":"f6c9a6f5-238f-46db-ae8a-f29d9d2efa05","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:8441b000ea1ed0432e32ca22820661e020b074f1f07470b49ea4828f57f3130a","observation_id":"b445ff47-9c5f-4b7d-937f-fd9fb84ffc18","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Chiu and K.-H","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:3845420bd0ef6709d3c37f3a8f444dff5cd0e2a1df827241c754cf374a3fdfc2","observation_id":"8a01e16d-4cd6-4861-8689-7ccebaa6fa36","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:848300797bb0f677b1a8623892695ee5aaa49c1e736c508c91be1cfbcb76c265","observation_id":"867d9cc3-9c85-4c94-ac8f-223720597df0","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:2d5d3440868595321c3e139f281b3e90c48ab5f2256657d5d64181e6684d6223","observation_id":"612d88f8-3695-4df6-a07d-45656ebfb310","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.03928","last_updated":"2017-02-12T22:05:47Z","snapshot_observed_at":"2026-08-14T21:25:52.327796Z","submitted_at":"2016-12-12T21:15:57Z","title":"Paying More Attention to Attention: Improving the Performance of Convolutional Neural Networks via Attention Transfer","version":3},"cited_work":{"arxiv_id":"1612.03928","doi":"10.48550/arxiv.1612.03928","metadata_source":"pith","pith_arxiv_id":"1612.03928","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Paying More Attention to Attention: Improving the Performance of Convolutional Neural Networks via Attention Transfer","venue":"cs.CV","work_id":"1e2bd9b4-867c-484f-bb3d-f2f9be85419a","year":2016},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"cited_paper":"/paper/1612.03928","citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:2e3bb18676a32f36693ca4387afd9f195d3ba2d46c06d9010bd19762442a8ac8","observation_id":"2b456326-f510-48f2-95aa-19dcf8d09b12","resolution":{"observed_at":"2026-06-29T11:23:20.847548Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-07-11T19:50:22.086713+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T19:50:22.086713+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:6d1e3e459799a42d8396d5ddb6bc8a23ddc515ea58119d713d06b4c0520e5ef7","observation_id":"b15eca28-7c97-4a48-bcb3-89c464223a64","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Chen and C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:a8d128f9ac928a4b7abc4bba8716d6363df8ed22541c38a8e0f9160ffcd5d28a","observation_id":"59a16901-0729-4942-a037-8760739e3699","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:b1bd60ef701a31b8f81449a6cacd5cafdf6d8d19956334f99105e9fd98501197","observation_id":"40a10b0d-4f02-4f39-a32c-d315dc532aa0","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Wang and X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:164583bb866e0ae5fea1a128134019bc2006f168fe351228db4de68dae62efc9","observation_id":"878bfa15-344d-42d5-a034-1dbdd21a8c62","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"and Lempitsky, V","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:77855807e83192b79ec199073c25cf24744651eb0715ae0cca9eedbe102a66aa","observation_id":"a5aea24b-d185-4223-a5d4-2f1b4d35f5b1","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:3b4f69b9ae8bfbbb2c54537bfe02488780e4c13aa87eaa824a021eea0c85e20c","observation_id":"4478cdda-8ec1-48fb-b26d-768b8cc4d616","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:6660de3fde6ed3f76f469e371647e36e7d46cb1764fca10f1d5bcfebd965158c","observation_id":"72ba2e28-6920-48f1-858f-0074a15d5c0b","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"Y., et al","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:e0b44988a08a4c89d83add3ae4c5f21b0122a51408576d1ce4a9e2370203ed21","observation_id":"3b27dca7-38a1-459f-8c2d-0fb145281142","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:02f33e5b371b81445f1bc0aff9b836a7da42fcb209c5cc6fbe6dd3f344e80fc8","observation_id":"2307e5ad-defc-44a6-832a-7fc8ef0ae9e3","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.02731","last_updated":"2019-01-08T13:03:14Z","snapshot_observed_at":"2026-08-14T17:33:46.262116Z","submitted_at":"2019-01-08T13:03:14Z","title":"A Comprehensive guide to Bayesian Convolutional Neural Network with Variational Inference","version":1},"cited_work":{"arxiv_id":"1901.02731","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.02731","snapshot_observed_at":"2026-07-10T21:37:42.043939Z","title":"A Comprehensive guide to Bayesian Convolutional Neural Network with Variational Inference","venue":"cs.LG","work_id":"6227c160-f716-44cb-ba45-5b89528b43ba","year":2019},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"cited_paper":"/paper/1901.02731","citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:90db195a2dfd57d42507e6314d99ebf6f95ace73a09d468adb9b17b5297f17d2","observation_id":"69f3d429-82a2-4491-a068-95b8a07d3b2a","resolution":{"observed_at":"2026-06-29T11:23:20.852696Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"E., Wang, Y., Huang, H., McGarvey, P","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:6bb58b82fe131a8230b16a58ae1ab16f492da1979dd8c6694f63a4e7c66699bc","observation_id":"38903c69-faa3-48b0-a440-64b3e02f78a9","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:2c8fc7febbd17f88387bef53315e87e14017b9ab63489973f870bb412e420558","observation_id":"bc2a3351-bc73-4610-90d0-908aea95c0f9","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:f80c9d80472f8c401fa1647b1199979d5d5159ef63e0fd040f372d60a307b7ba","observation_id":"47d25895-627b-4360-b204-56f6e7c98754","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:1593efdb92a8803014c350b28f7dda93603e678a56df579ac714f3d8903c9411","observation_id":"11791ece-06c2-4182-9aaf-f456b82acf42","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:19:42.981402Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-06-29T11:19:42.981402Z"},"links":{"citing_paper":"/paper/2605.27967"},"observation_digest":"sha256:080dc1aa1c7a9c1f3e51f0fd35679a3cc04f4c3e05954e15481e17b663a38501","observation_id":"9ca8d022-aef0-479b-8f83-d3152761575f","resolution":{"observed_at":"2026-06-29T11:19:42.981402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.27967","last_updated":"2026-05-27T05:03:24Z","latest_version":1,"primary_category":"stat.ME","snapshot_observed_at":"2026-08-08T12:42:00.100000Z","submitted_at":"2026-05-27T05:03:24Z","title":"Multi-Teacher Knowledge Distillation via Teacher-Informed Mixture Priors"},"reference_resolution":{"displayed":73,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":65,"verified_exact":8,"verified_fuzzy":0},"total_outbound_references":73},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 73 of 73 outbound references and 0 inbound Pith citation observations for arXiv:2605.27967."}