{"as_of":"2026-08-08T02:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c49764a2ac31d2474afad43797871c50ca2a46037944ce391f6ae669a5b8b4b2","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:59:04.474835Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.23041/citation-record","integrity":"/paper/2506.23041/integrity","json":"/paper/2506.23041/citation-record.json","paper":"/paper/2506.23041"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:59:06.894748Z","title":"org/CorpusID:235313572","venue":null,"work_id":"f1e801de-d259-4b69-aec5-f4697b211a01","year":null},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:02.309250Z"},"links":{"citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:5e1c437f2301c9e5877824b103f0c93841f552ee4dccd9f762b3a471abf1b4cf","observation_id":"1a21bb63-bbd7-47c6-a881-3cd9f27552f3","resolution":{"observed_at":"2026-08-06T21:59:07.020633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:59:06.524534Z","title":"org/CorpusID:231573431","venue":null,"work_id":"4f96becc-062b-465c-84a4-94f7d4fe508e","year":2004},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:02.807249Z"},"links":{"citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:7f0bd5187a8de2ac39efd9e52354ee6f316c7485caf9435ebc3c9dd43dd33b9e","observation_id":"1da74c2e-4a4e-4320-8af0-ca6d0aebcccd","resolution":{"observed_at":"2026-08-06T21:59:06.640800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-06T21:59:03.010079Z","title":"org/CorpusID:222134093","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:03.010079Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:86c1424f31dea4b12d02e14291706b132dfd2394a13cd548359bda734b02e18e","observation_id":"8bc0af0a-1f93-4ce6-98ea-f6c8e8ee65b1","resolution":{"observed_at":"2026-08-06T21:59:03.010079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00109","last_updated":"2017-04-01T02:42:55Z","snapshot_observed_at":"2026-07-06T05:36:07.769337Z","submitted_at":"2017-04-01T02:42:55Z","title":"Snapshot Ensembles: Train 1, get M for free","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.00109","snapshot_observed_at":"2026-08-06T21:59:03.117601Z","title":"org/CorpusID:235458009","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:03.117601Z"},"links":{"cited_paper":"/paper/1704.00109","citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:f283cd0b1f52178bd340c212dd5efc22a195237bcd350e3f33d8929bde921b50","observation_id":"fb7c0860-0a32-4510-b856-ac9124138d04","resolution":{"observed_at":"2026-08-06T21:59:03.117601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10536","last_updated":"2022-12-28T04:02:19Z","snapshot_observed_at":"2026-07-06T13:12:20.915375Z","submitted_at":"2022-05-21T08:30:58Z","title":"Knowledge Distillation from A Stronger Teacher","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10536","snapshot_observed_at":"2026-08-06T21:59:03.212341Z","title":"org/CorpusID:6820006","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:03.212341Z"},"links":{"cited_paper":"/paper/2205.10536","citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:0e6837b3b5c466f525477b3d3b2c0802237c71d363af8337002d9c48acbcecd8","observation_id":"db542d8a-5275-4aa3-b1df-486af372b356","resolution":{"observed_at":"2026-08-06T21:59:03.212341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.07650","last_updated":"2022-01-23T13:47:18Z","snapshot_observed_at":"2026-08-07T22:52:01.012389Z","submitted_at":"2021-02-12T07:00:17Z","title":"Learning Student-Friendly Teacher Networks for Knowledge Distillation","version":4},"cited_work":{"arxiv_id":"2102.07650","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.07650","snapshot_observed_at":"2026-08-06T21:59:04.705466Z","title":"Learning Student-Friendly Teacher Networks for Knowledge Distillation","venue":"cs.LG","work_id":"60d39260-683b-47bf-9962-065a4b83d043","year":2021},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:03.521559Z"},"links":{"cited_paper":"/paper/2102.07650","citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:860faec730cf15757a168a1233a5b98dc6c321e9a6e12ebb2c8cf20759f744a0","observation_id":"4d0754e4-32fa-4aad-be21-14f966f57f18","resolution":{"observed_at":"2026-08-06T21:59:04.757704Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"physics/0004057","last_updated":"2000-04-24T15:22:30Z","snapshot_observed_at":"2026-08-07T10:46:08.274157Z","submitted_at":"2000-04-24T15:22:30Z","title":"The information bottleneck method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"physics/0004057","snapshot_observed_at":"2026-08-06T21:59:03.717723Z","title":"org/CorpusID:235485156","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:03.717723Z"},"links":{"cited_paper":"/paper/physics/0004057","citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:d6a6ac5e176f8a7d482bd6cb3d2a7f97583b46ed064fb46c8a2c6a6b1d24c4bb","observation_id":"26fa57dc-10f1-4d3f-8d0b-1fb65d325fa3","resolution":{"observed_at":"2026-08-06T21:59:03.717723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06458","last_updated":"2022-10-12T17:55:30Z","snapshot_observed_at":"2026-08-06T11:52:43.411941Z","submitted_at":"2022-10-12T17:55:30Z","title":"Efficient Knowledge Distillation from Model Checkpoints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06458","snapshot_observed_at":"2026-08-06T21:59:03.898277Z","title":"org/CorpusID:47021742","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:03.898277Z"},"links":{"cited_paper":"/paper/2210.06458","citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:34730c9876a7341e3fcda7e12825c64e0b31f7f50f9a9fb45e1f71d76858c3a3","observation_id":"9395c685-25cf-4dc0-b0b2-cbffc692653c","resolution":{"observed_at":"2026-08-06T21:59:03.898277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:59:05.552018Z","title":"org/CorpusID:231709464","venue":null,"work_id":"8a16c1ab-6d9a-4836-9a01-cfdffec8212e","year":2010},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:04.030032Z"},"links":{"citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:446049be917cfe3fad891c4f3c31bafc4bca8dd3fe7a33031e1acf364e5e3dc1","observation_id":"264958c2-f872-45b3-8043-34cd3702246d","resolution":{"observed_at":"2026-08-06T21:59:05.649545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.01996","last_updated":"2022-03-08T21:16:04Z","snapshot_observed_at":"2026-07-06T07:31:24.618910Z","submitted_at":"2019-02-06T01:29:01Z","title":"Are All Layers Created Equal?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.01996","snapshot_observed_at":"2026-08-06T21:59:04.152399Z","title":"org/CorpusID:214317405","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:04.152399Z"},"links":{"cited_paper":"/paper/1902.01996","citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:fb5b06ddeab3eda0d89b10757ee83e54eb5edfaab7435a32999eaef259d32e02","observation_id":"db0ec522-62c2-4814-85f6-71c442593952","resolution":{"observed_at":"2026-08-06T21:59:04.152399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-07-06T06:06:04.571585Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-06T21:59:04.259579Z","title":"org/CorpusID:59606288","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:04.259579Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:ed17543711b84d918b69d3fed63658c58912711af94c1bb47f270797ad91216e","observation_id":"f8a0f948-cb4c-4db3-8dc1-2585378a0276","resolution":{"observed_at":"2026-08-06T21:59:04.259579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:59:05.387154Z","title":"org/CorpusID:247958465","venue":null,"work_id":"2b9a127f-236c-4c92-99aa-6a9c72c49de0","year":null},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:04.379762Z"},"links":{"citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:bbc691bbcfa2637cbdbf2785c7211a4015a8c6260fdbbfad2e80cc000fee3879","observation_id":"85f080ad-911e-45e5-9d8f-9af2d3f092b8","resolution":{"observed_at":"2026-08-06T21:59:05.470908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:59:05.220644Z","title":"org/CorpusID:258509000","venue":null,"work_id":"69ebb77e-476f-4b1d-b91b-795a9a6bf5d3","year":2018},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:04.474835Z"},"links":{"citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:012e0ab31458dad86de1402e0ab49ada68f397652f3ba035004a5577e7399c1f","observation_id":"512a38fe-c230-45a4-a49c-4ac6031224c2","resolution":{"observed_at":"2026-08-06T21:59:05.276079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:59:05.734666Z","title":"org/CorpusID:8936496","venue":null,"work_id":"6b8c0ba1-ce56-40fc-b9ab-00f8703d3792","year":2018},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:03.793410Z"},"links":{"citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:1c020209d2e23a13c964ab94727b5e28d0db1088fecb68309467068aafd2917a","observation_id":"2a18f67f-0d00-44f3-8e2b-ddaf22921ed8","resolution":{"observed_at":"2026-08-06T21:59:05.800159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.01412","last_updated":"2021-04-29T16:44:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-03T19:02:10Z","title":"Sharpness-Aware Minimization for Efficiently Improving Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.01412","snapshot_observed_at":"2026-08-06T21:59:02.912839Z","title":"org/CorpusID:2156851","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:02.912839Z"},"links":{"cited_paper":"/paper/2010.01412","citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:1ab9ac1c79854ce1e4c7a6cfe27d58f91f589a0406c1a2f9f21db9b4b869be64","observation_id":"cfb0ea29-5adb-4013-98fb-2e88254d141f","resolution":{"observed_at":"2026-08-06T21:59:02.912839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:59:06.146033Z","title":"org/CorpusID:16632981","venue":null,"work_id":"bbae0202-1b50-49b5-acc8-3b2e361a54c9","year":2009},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:03.433693Z"},"links":{"citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:2c95a18138eb2d7ef87aa3cb718de290fa393ce0b5224a53dd3074c5b35a5501","observation_id":"c50d81ad-7695-481a-81a2-174dc3ba28c8","resolution":{"observed_at":"2026-08-06T21:59:06.220833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01548","last_updated":"2022-03-13T18:58:43Z","snapshot_observed_at":"2026-07-06T11:15:26.915483Z","submitted_at":"2021-06-03T02:08:03Z","title":"When Vision Transformers Outperform ResNets without Pre-training or Strong Data Augmentations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.01548","snapshot_observed_at":"2026-08-06T21:59:02.184937Z","title":"org/CorpusID:12726540","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:02.184937Z"},"links":{"cited_paper":"/paper/2106.01548","citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:cd834b81deaaffd0ea392892923625468fdb78ae599a402575f93cdc3ddbd03a","observation_id":"f7300abd-98b4-4076-8181-07c453209977","resolution":{"observed_at":"2026-08-06T21:59:02.184937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:59:02.424571Z","title":"doi: 10.1109/jproc.2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:02.424571Z"},"links":{"citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:4861023add519894ec58bab2a5009e26dfec643a301100571208ca652be99dcb","observation_id":"48697a82-ce17-4232-a3f1-9b0f8e581c63","resolution":{"observed_at":"2026-08-06T21:59:02.424571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:59:05.910231Z","title":"org/CorpusID:4555207","venue":null,"work_id":"fcbf152f-cac0-47fe-8ab1-3bde58b9c7c2","year":2022},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:03.634486Z"},"links":{"citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:121671e9c682e982dd788e2a8f8e5f7c3efb409d64d91adc198676f1c918b835","observation_id":"5527296b-55a6-4f6f-ae23-5ea772b797d2","resolution":{"observed_at":"2026-08-06T21:59:06.012488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:59:06.334755Z","title":"org/CorpusID:214728308","venue":null,"work_id":"47fd2791-dca8-43f8-8a4d-76b9734fa05c","year":2019},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:03.345302Z"},"links":{"citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:9a05faa48b39e8d84245c8448d2784a0048787a3c173861248692c3aec78f50f","observation_id":"e593c8dd-f02c-4c53-8d08-adc5a2ed4614","resolution":{"observed_at":"2026-08-06T21:59:06.417876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:59:06.728173Z","title":"org/CorpusID:225039882","venue":null,"work_id":"0f0f4422-bf8f-4487-a85e-0c2c9e99429e","year":null},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:02.699070Z"},"links":{"citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:7c306afd6aebcc68b36598595b6ffc8cc9d54035457f6119a5f78fbcb5cd56f3","observation_id":"783f4886-2da7-4eb9-9bdf-e5a1ba24245e","resolution":{"observed_at":"2026-08-06T21:59:06.825118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:59:07.151436Z","title":"org/CorpusID:235376877","venue":null,"work_id":"fbe71b51-a1d8-4188-88a2-1bcfaca47b0f","year":null},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:02.080408Z"},"links":{"citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:e4ad82dea0ef7d9044a4eb9489a5e7f5125e10d3d87c1f7961d831e7195a5d49","observation_id":"d9f94d10-a10a-4886-bade-63f20a41e2ca","resolution":{"observed_at":"2026-08-06T21:59:07.277509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T21:59:02.614567Z","title":"org/CorpusID:249642077","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:02.614567Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:d35b68d136e917060df6a5e5694eeb46acabf6967fe0a5e40f9c1dd634247c80","observation_id":"d32fc73e-e205-48cd-bacd-0e1a725ea378","resolution":{"observed_at":"2026-08-06T21:59:02.614567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.06661","last_updated":"2024-05-09T09:33:20Z","snapshot_observed_at":"2026-08-06T18:47:19.914447Z","submitted_at":"2022-06-14T07:51:25Z","title":"Toward Student-Oriented Teacher Network Training For Knowledge Distillation","version":2},"cited_work":{"arxiv_id":"2206.06661","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.06661","snapshot_observed_at":"2026-08-06T21:59:04.957495Z","title":"Toward Student-Oriented Teacher Network Training For Knowledge Distillation","venue":"cs.LG","work_id":"ce5ddbc5-b717-43be-9337-9d98a4f22ca2","year":2022},"citing_paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:02.522612Z"},"links":{"cited_paper":"/paper/2206.06661","citing_paper":"/paper/2506.23041"},"observation_digest":"sha256:3c49f1dee6858bc28a723eab89b0eb51f4c6b46d40c711df8bfae568cf04363f","observation_id":"6810cb9a-5ab2-4015-8345-9f36fe88831e","resolution":{"observed_at":"2026-08-06T21:59:05.033513Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.23041","last_updated":"2025-06-29T00:25:23Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T21:49:27.380241Z","submitted_at":"2025-06-29T00:25:23Z","title":"ReMem: Mutual Information-Aware Fine-tuning of Pretrained Vision Transformers for Effective Knowledge Distillation"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2506.23041."}