{"as_of":"2026-08-12T21:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7c08d832a1260a747b6fc8421f458ac9a04d3cf5b60e6f2b77e7ff67ed1a162d","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T16:19:29.070092Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T02:07:27.600563Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T18:25:57.505603Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"cited_work":{"arxiv_id":"2501.13341","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.13341","snapshot_observed_at":"2026-07-01T18:25:57.505603Z","title":"arXiv preprint arXiv:2501.13341 , year=","venue":null,"work_id":"badc997c-38c6-4427-ba09-1f3b41a256be","year":null},"citing_paper":{"arxiv_id":"2606.27527","last_updated":"2026-06-25T20:19:50Z","snapshot_observed_at":"2026-07-07T00:01:44.678954Z","submitted_at":"2026-06-25T20:19:50Z","title":"Large Language Model Teaches Visual Students: Cross-Modality Transfer of Fine-Grained Conceptual Knowledge","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-06-29T02:07:27.600563Z"},"links":{"cited_paper":"/paper/2501.13341","citing_paper":"/paper/2606.27527"},"observation_digest":"sha256:0556a36e9873790352f583fee309f43790ff9e4f14b74acf6bfefc25a2eee4f0","observation_id":"169e2075-9a3e-44a0-b930-a594ad1de2eb","resolution":{"observed_at":"2026-07-01T18:25:57.507270Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.13341/citation-record","integrity":"/paper/2501.13341/integrity","json":"/paper/2501.13341/citation-record.json","paper":"/paper/2501.13341"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T16:19:28.905738Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.905738Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:634b84265e619cdd8fef4f45a8cc76b6cc73a6da6ac5031337525d3a28faecd3","observation_id":"87192714-0c32-49c2-b591-ad57c5f36454","resolution":{"observed_at":"2026-08-10T16:19:28.905738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:28.910453Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.910453Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:fc6f69fca59c18a074f175ce2ca94b48222a2ed3c68d9890a6d72fcec6e9412d","observation_id":"41a94c60-5d80-4d35-afef-6e9035f9f320","resolution":{"observed_at":"2026-08-10T16:19:28.910453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.16410","last_updated":"2023-06-28T17:57:10Z","snapshot_observed_at":"2026-08-12T11:22:04.135857Z","submitted_at":"2023-06-28T17:57:10Z","title":"Towards Language Models That Can See: Computer Vision Through the LENS of Natural Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.16410","snapshot_observed_at":"2026-08-10T16:19:28.914427Z","title":"Towards language models that can see: Computer vision through the lens of natural lan- guage","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.914427Z"},"links":{"cited_paper":"/paper/2306.16410","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:9cca65cfede1b64ef2b19f21c47aba504058c3a757f1058389db463c0d17e92a","observation_id":"b4cd63d5-89b2-4ca3-81d8-c1d3e467b73c","resolution":{"observed_at":"2026-08-10T16:19:28.914427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.600241Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":"1d25c299-a4b7-4e2b-9d60-a7cf7dd9f93f","year":2024},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.919178Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:8622acf04fc0711fc3284e9ada8b4ecbc6880730226399f4757a69f1d919e1bb","observation_id":"bdf7d593-e399-45a9-a1c9-6aa776019d63","resolution":{"observed_at":"2026-08-10T16:19:29.604668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.586269Z","title":"Describing textures in the wild","venue":null,"work_id":"e0e3e259-518e-4aa7-bd6a-f251beb45655","year":2014},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.924572Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:3209a75f9752703717c5b7c47332302769361a6d241c8d114f716d2469d3bf83","observation_id":"8f4a13e1-d3ff-4d04-867b-0f2303c63869","resolution":{"observed_at":"2026-08-10T16:19:29.590953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.573806Z","title":"Learning gener- ative visual models from few training examples: An incre- mental bayesian approach tested on 101 object categories","venue":null,"work_id":"fe05bf9d-8e5e-46c9-b85e-85a0fa12cc1e","year":2004},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.928836Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:00280f155f6b40423c42802757a57fedca812304fca195638794f61e6006eb8e","observation_id":"90193cc7-2f14-4385-ba25-0219b275249d","resolution":{"observed_at":"2026-08-10T16:19:29.578373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.559972Z","title":"From im- ages to textual prompts: Zero-shot visual question answer- ing with frozen large language models","venue":null,"work_id":"0f38115a-1d6b-4585-ab53-53d38f55c4cf","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.932652Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:183f0ed170fa64821a2cf625d6fa742533c0031df1f5e4ebbeac782704cf602d","observation_id":"d45094b3-47f0-42f0-b65e-5b4c3cb6b06d","resolution":{"observed_at":"2026-08-10T16:19:29.564390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.544035Z","title":"Class attention transfer based knowledge distillation","venue":null,"work_id":"df056499-9fd4-4a73-9e18-79ea61f49c16","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.936567Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:24d44e8b5443060cd99c6300b520f011dd053ed289d59a86f3bcd0f9a7bae824","observation_id":"db16b673-b6df-4639-933f-a3240ac90355","resolution":{"observed_at":"2026-08-10T16:19:29.549160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:28.940489Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.940489Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:827e5b3a94fa2758182963e8ab125804309722c43e09a7ecf4566afc9de31e35","observation_id":"9ef32812-2014-4c1f-9f24-1eb6a295b55f","resolution":{"observed_at":"2026-08-10T16:19:28.940489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.518863Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":"da4e80e2-7030-4eaa-b643-8c05fbcc601b","year":2013},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.944045Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:3923e02344a355f718c79bc1e7fc75b8579dde3c79152c2de2249338b3b675e3","observation_id":"b97a64d7-33b3-4e3a-a0af-0e77e40fe2a7","resolution":{"observed_at":"2026-08-10T16:19:29.523140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:28.947671Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.947671Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:8ad614a0da3feafb997cb54420dcd974e7ee5253552eda14b27ab0a54ad50bea","observation_id":"5460466e-e62f-4831-8646-3abde2e8dd95","resolution":{"observed_at":"2026-08-10T16:19:28.947671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.494302Z","title":"Feature pyra- mid networks for object detection","venue":null,"work_id":"05e5c426-5c26-46cc-a998-4204709a081b","year":2017},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.951432Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:6ddfc39491e7019ecd349cb2748b0bf9c4c5c4eba3098c31e3da8dbe276f540b","observation_id":"4403aaf1-55cf-4307-8c29-0b362132b9a1","resolution":{"observed_at":"2026-08-10T16:19:29.498469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.480297Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":"39f14b85-9961-4865-8230-73135928e5f9","year":2024},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.955955Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:c33e5da7323d7e68208f49ad1c5b75a883df3f6de1d14ed64b5830f9f6b28fd2","observation_id":"20f2c352-564c-4514-9b09-cbb207d03cd1","resolution":{"observed_at":"2026-08-10T16:19:29.485383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:28.959587Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.959587Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:44998f39f7f636d89683ed3c4fd49a0c812d94a2c5532d357fbe14ff6bdc6c9d","observation_id":"377ad3b4-9532-48fd-9732-1b7d67742ba7","resolution":{"observed_at":"2026-08-10T16:19:28.959587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:28.962651Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.962651Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:0bde69b3496cc0686cfac53a18630231ed74625271f82fa688b4cd060d0964e9","observation_id":"34b1547d-67f7-4160-a2e3-0a67db4e2744","resolution":{"observed_at":"2026-08-10T16:19:28.962651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.452537Z","title":"Annealing- based label-transfer learning for open world object detection","venue":null,"work_id":"9f3851fc-17c4-457a-97b1-a5cccff358ec","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.966063Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:9c55ca629c45399f4ea7a119c0ac668a97382844658b8456460fad7c893f1c85","observation_id":"50344ca4-da0d-40fc-8941-aff0c7d2200d","resolution":{"observed_at":"2026-08-10T16:19:29.456617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-08-12T17:35:23.022229Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-10T16:19:28.969633Z","title":"Fine-grained visual classi- fication of aircraft","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.969633Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:4970f17ed888d5fd44bd8b3132325a720259bde96f6ad1a9db0739a083c46cd1","observation_id":"63523cf7-ef10-4ab3-bea6-bfa327d99607","resolution":{"observed_at":"2026-08-10T16:19:28.969633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07183","last_updated":"2022-12-01T17:38:37Z","snapshot_observed_at":"2026-08-08T07:53:13.926951Z","submitted_at":"2022-10-13T17:03:46Z","title":"Visual Classification via Description from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07183","snapshot_observed_at":"2026-08-10T16:19:28.974014Z","title":"Visual classification via description from large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.974014Z"},"links":{"cited_paper":"/paper/2210.07183","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:e7aa51686cce326f66a1166430673cb0e8cba890b7b828550c57959e009221ca","observation_id":"6c6d9aa8-c2d9-47fa-b682-8f83f4d782bb","resolution":{"observed_at":"2026-08-10T16:19:28.974014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.440099Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":"cd0f6dd6-d570-4769-8d68-a0ee540cc77b","year":2008},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.977936Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:cb17dbc18c8ac6318935b130dd810eb54e1b33d93a65fd9811952eb92146aca6","observation_id":"78c58dc4-fb9d-4647-bc35-d1e1a7c474c8","resolution":{"observed_at":"2026-08-10T16:19:29.444800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.427039Z","title":"Chils: Zero-shot image classification with hierarchical label sets","venue":null,"work_id":"06a244e0-1439-4ff1-8ed2-49b86c39839d","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.981783Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:67b948dcc85331e623c29b4b76edf049ee20e68bd72395ae835a4dec9de8c1c9","observation_id":"bf37bc1a-acb4-4f0b-b50c-0162577748c6","resolution":{"observed_at":"2026-08-10T16:19:29.431265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.413175Z","title":"Dinov2: Learning robust visual features with- out supervision, 2024","venue":null,"work_id":"1f185599-f57b-48d3-9477-b9f87eae7015","year":2024},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.985433Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:5074182e4344db517dfadd958ef1c1de5ce881a9387c9b6f35884c5a799fcfa8","observation_id":"e4614a99-4e96-4517-8e13-25d437dc070e","resolution":{"observed_at":"2026-08-10T16:19:29.418047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.399798Z","title":"Cats and dogs","venue":null,"work_id":"dc243d31-37e1-40df-99e5-667a8234bfaf","year":2012},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.989574Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:a4b262dbd3c0e97fdb7abe96919e474abbc7e5eefc1673ecfcee2b0c9c07f1b6","observation_id":"7959c138-c6b6-4821-866c-2b88918ad4fa","resolution":{"observed_at":"2026-08-10T16:19:29.403759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:28.993593Z","title":"What does a platypus look like? generating customized prompts for zero-shot image classification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.993593Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:d70585b4f7b7d3eab28f79ae717723f28602c2c123d4d305a209601070279b88","observation_id":"a2b34a0d-42ff-4947-966c-bf54e5a8445f","resolution":{"observed_at":"2026-08-10T16:19:28.993593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.380109Z","title":"Optimization as a model for few-shot learning","venue":null,"work_id":"d9e84780-0124-4be1-aad8-e693867059c6","year":2016},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:28.997174Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:43028a0d415a24aaf2c33fc6622083d31df316e977108b1a5e74de775d26c59c","observation_id":"5153617c-8f02-41d6-9059-eab7e64b3297","resolution":{"observed_at":"2026-08-10T16:19:29.384413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.001068Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.001068Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:4f08f7f6fda95209dc1bf0cd524fb5a022fb969eec961714400996bb507476a2","observation_id":"f8d8ff93-1720-4098-ba99-181776a97735","resolution":{"observed_at":"2026-08-10T16:19:29.001068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.01628","last_updated":"2021-11-02T14:41:11Z","snapshot_observed_at":"2026-07-06T12:04:39.450849Z","submitted_at":"2021-11-02T14:41:11Z","title":"Human Attention in Fine-grained Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.01628","snapshot_observed_at":"2026-08-10T16:19:29.004633Z","title":"Human attention in fine-grained classification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.004633Z"},"links":{"cited_paper":"/paper/2111.01628","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:42c2a1115456df9d9038806ff360e6c9fd11ea8da339135f3534f8185463501b","observation_id":"c503dbb7-ee66-4203-8f69-81be1e142b43","resolution":{"observed_at":"2026-08-10T16:19:29.004633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.361587Z","title":"In-context impersonation reveals large language models’ strengths and biases","venue":null,"work_id":"d01fc9d1-5f42-4f83-a69b-64033a2a2544","year":2024},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.008742Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:a366cfc96f3eb86652100e39ceff958259fafafb5648050c1d87d632484c0b5e","observation_id":"a7117520-d90b-44ba-816a-bcf97ba05efd","resolution":{"observed_at":"2026-08-10T16:19:29.366112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.012301Z","title":"Efficientnet: Rethinking model scaling for convolutional neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.012301Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:071bf4a6d6c724835fae63b716eafe5ed413ba001604ab15fe336b9e9c745ce1","observation_id":"31f42e38-9f16-4581-b91f-7b5d5762bffd","resolution":{"observed_at":"2026-08-10T16:19:29.012301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.342246Z","title":null,"venue":null,"work_id":"8b954312-f69b-4094-b632-c077b5cf1e7e","year":2021},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.015958Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:ca6f3f1a6f3832db0a23e3e833d50fa7f2d2cac0f685b77465239e08a98830e4","observation_id":"6928faf9-5b6e-461a-9c0b-00ef4dbb3974","resolution":{"observed_at":"2026-08-10T16:19:29.346166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.328928Z","title":"Fastvit: A fast hybrid vision transformer using structural reparameterization","venue":null,"work_id":"c4ebe481-c7ac-4da9-ae6d-7ea5cd0717c2","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.019474Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:e9e0f7a0e7b4ae7f54b4a79757e2ae39f26073cfa4e84a943885b72d2240db41","observation_id":"c3124c18-82cd-4b81-8871-a07ffbf7ac39","resolution":{"observed_at":"2026-08-10T16:19:29.333768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.022975Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.022975Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:729ed5d0df5984d9fe186a6a2c1eb988a1071e1f56d888d9bfdf00c08f3c126b","observation_id":"eb734600-36a7-4062-90b6-31ff4a4b9d10","resolution":{"observed_at":"2026-08-10T16:19:29.022975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.309225Z","title":"The caltech-ucsd birds-200-2011 dataset","venue":null,"work_id":"15e3bffc-a0bd-484a-95a0-d7063c4953f0","year":2011},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.026811Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:e0a00b9d2ef034e6d4d41038915b751455ac281d90ea88567aaa6aa2d80298bb","observation_id":"22dd06de-e136-421d-b496-a2a53cf7856c","resolution":{"observed_at":"2026-08-10T16:19:29.313427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.295614Z","title":"Bi-lrfusion: Bi-directional lidar-radar fusion for 3d dynamic object detection","venue":null,"work_id":"8d1de9bd-67f9-4620-b348-1a4b0058ddef","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.030281Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:c279494c2ae50fd84c6599bf48dc467a7532915a22b9541e53c24960f97adb6a","observation_id":"57186486-171e-4f14-a877-244491928662","resolution":{"observed_at":"2026-08-10T16:19:29.301104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10904","last_updated":"2022-05-15T23:20:46Z","snapshot_observed_at":"2026-08-06T05:59:00.316195Z","submitted_at":"2021-08-24T18:14:00Z","title":"SimVLM: Simple Visual Language Model Pretraining with Weak Supervision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.10904","snapshot_observed_at":"2026-08-10T16:19:29.033903Z","title":"Simvlm: Simple visual language model pretraining with weak supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.033903Z"},"links":{"cited_paper":"/paper/2108.10904","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:5c023788133c6c8864743e3a3e2f988c7d47abe24bb9be556975ed7ad15fc3a5","observation_id":"8631da16-cc6f-4f78-b72b-077e1824f250","resolution":{"observed_at":"2026-08-10T16:19:29.033903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.283191Z","title":"Fine-grained image analysis with deep learning: A survey","venue":null,"work_id":"b22873b4-b36f-47d7-976a-ab8521eac1b2","year":2021},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.037673Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:023ebc63f4220ee0d2e52964dc431511faccb50915b77701ee7d5954618b2e4f","observation_id":"da451358-4637-4d83-a448-b63dbded10db","resolution":{"observed_at":"2026-08-10T16:19:29.287347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.269918Z","title":"Aligning bag of regions for open- vocabulary object detection","venue":null,"work_id":"3f5b9ac6-7595-4991-bac3-943b74c91e2e","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.041714Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:9ef4103f0d6380a823035c71ebeb7407659a469cdab73e1fcb98a6c7c8766a51","observation_id":"e28e0839-e736-4add-b77c-60dc70bebbb6","resolution":{"observed_at":"2026-08-10T16:19:29.274985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.045302Z","title":"Learning concise and descriptive attributes for visual recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.045302Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:9795a48009ac54c9dff444a0b0d8e36188675632fb5b0fee5d26443da4d93161","observation_id":"a89f0db4-f30e-4cf1-89f5-24fed1d92ff2","resolution":{"observed_at":"2026-08-10T16:19:29.045302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.246639Z","title":"Language in a bottle: Language model guided concept bottlenecks for interpretable image classification","venue":null,"work_id":"316fd961-8307-4d15-952b-11ce4212f90c","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.049001Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:977bc71a8810e1ada025381a4a4848e7a87b83a068909909f0466b151a162379","observation_id":"d5d9f91a-5ba8-444c-a1df-1e969abad942","resolution":{"observed_at":"2026-08-10T16:19:29.251103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.232532Z","title":"An empirical study of gpt-3 for few-shot knowledge-based vqa","venue":null,"work_id":"2059c4f5-aa50-4841-a2a7-b090c886bb09","year":2022},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.052489Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:92a43db28b196f43604434935da96c8ed731b71b615a83e97ac63cc139e840cf","observation_id":"fe40967f-f5f6-41d5-a55e-ffd2a190c72a","resolution":{"observed_at":"2026-08-10T16:19:29.238072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-10T16:19:29.055832Z","title":"A survey on multimodal large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.055832Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:d4bbe7ad30272b799859a159746103e19d4240c5db769db79bbc33e2f282d114","observation_id":"df4f2b3d-11ad-4faa-837a-f3624eaf9934","resolution":{"observed_at":"2026-08-10T16:19:29.055832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13601","last_updated":"2024-05-28T05:36:23Z","snapshot_observed_at":"2026-08-10T21:32:36.140961Z","submitted_at":"2024-01-24T17:10:45Z","title":"MM-LLMs: Recent Advances in MultiModal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13601","snapshot_observed_at":"2026-08-10T16:19:29.059340Z","title":"Mm-llms: Recent ad- vances in multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.059340Z"},"links":{"cited_paper":"/paper/2401.13601","citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:8de40c8f759900a49f4e2d47e2eb61a1a5a2af2df7cbaa4870c4622ffe78b46e","observation_id":"5c24d812-e8ed-4e52-9351-5fdb11cff0fa","resolution":{"observed_at":"2026-08-10T16:19:29.059340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.062776Z","title":"Vinvl: Revisiting visual representations in vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.062776Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:6c22a4b9bf5cf2437ab7ac9891c3a80d596159e7b5b2427e4d7d741ac046b14b","observation_id":"4284d516-f62b-4318-b664-717dd7437b79","resolution":{"observed_at":"2026-08-10T16:19:29.062776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.212458Z","title":"Decoupled knowledge distillation","venue":null,"work_id":"6a26dcf3-b67d-47ee-8691-81010f0252ab","year":2022},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.066539Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:54f15facc932fc749cea61cf9dd47acdc6ae9ae9940768df1f2f3d85c2abdfd1","observation_id":"9b2c88ef-3885-4963-9a3f-1eadccb5281b","resolution":{"observed_at":"2026-08-10T16:19:29.216540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:19:29.197853Z","title":"Biformer: Vision transformer with bi-level routing attention","venue":null,"work_id":"9d5195fe-281f-498a-a628-9d54a2fafa17","year":2023},"citing_paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T16:19:29.070092Z"},"links":{"citing_paper":"/paper/2501.13341"},"observation_digest":"sha256:02baed9e5a9a1ddbba92dbaf269f4ac097880f363497626564f89c648e6e5ef7","observation_id":"5fd768fd-1861-4abe-856f-cdbdb0bd9fc8","resolution":{"observed_at":"2026-08-10T16:19:29.203688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.13341","last_updated":"2025-04-12T12:38:44Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T19:33:25.009319Z","submitted_at":"2025-01-23T02:45:35Z","title":"Multi-aspect Knowledge Distillation with Large Language Model"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2501.13341."}