{"as_of":"2026-08-10T00:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b5cc5e2407f56b53b71ec9202ffaccfd023ee8007201b0574312a0d3f655f9a3","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:42:59.797684Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:08:47.458634Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T11:10:17.246189Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15198","snapshot_observed_at":"2026-08-05T21:08:47.458634Z","title":"Collaborative distillation strategies for parameter-efficient language model deployment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09401","last_updated":"2025-08-13T00:35:58Z","snapshot_observed_at":"2026-08-08T03:09:41.451202Z","submitted_at":"2025-08-13T00:35:58Z","title":"Graph Neural Network and Transformer Integration for Unsupervised System Anomaly Discovery","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T21:08:47.458634Z"},"links":{"cited_paper":"/paper/2507.15198","citing_paper":"/paper/2508.09401"},"observation_digest":"sha256:4c84d5369d280cda4c6274b773bb4d770c638faa323f82337587212841baf12b","observation_id":"a24e37f5-0158-4681-8a5f-d86242db258d","resolution":{"observed_at":"2026-08-05T21:08:47.458634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15198","snapshot_observed_at":"2026-08-05T18:32:32.812628Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.14503","last_updated":"2025-08-25T09:09:12Z","snapshot_observed_at":"2026-08-08T13:02:24.190532Z","submitted_at":"2025-08-20T07:52:36Z","title":"Artificial Intelligence-Based Multiscale Temporal Modeling for Anomaly Detection in Cloud Services","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T18:32:32.812628Z"},"links":{"cited_paper":"/paper/2507.15198","citing_paper":"/paper/2508.14503"},"observation_digest":"sha256:b23a388d3e702bf58ffb9e6f8d726393008168e30375967181d567704a889e80","observation_id":"da36a741-19d3-4e9a-b29a-8a786cbf104d","resolution":{"observed_at":"2026-08-05T18:32:32.812628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"cited_work":{"arxiv_id":"2507.15198","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.15198","snapshot_observed_at":"2026-08-05T11:10:17.246189Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","venue":"cs.CL","work_id":"01a13b55-1433-4177-9b0b-e281f63a7cc6","year":2025},"citing_paper":{"arxiv_id":"2509.03057","last_updated":"2025-09-03T06:40:25Z","snapshot_observed_at":"2026-08-07T22:23:25.944234Z","submitted_at":"2025-09-03T06:40:25Z","title":"Structure-Learnable Adapter Fine-Tuning for Parameter-Efficient Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:16.081018Z"},"links":{"cited_paper":"/paper/2507.15198","citing_paper":"/paper/2509.03057"},"observation_digest":"sha256:beab28bdc9a3224d798b39665867b9a48e1ead48b21f0212e65174d7f54750fd","observation_id":"d9b057bb-e1f4-476a-bb04-ca8799d69fb5","resolution":{"observed_at":"2026-08-05T11:10:17.383261Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.15198/citation-record","integrity":"/paper/2507.15198/integrity","json":"/paper/2507.15198/citation-record.json","paper":"/paper/2507.15198"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.08543","last_updated":"2026-01-31T09:16:35Z","snapshot_observed_at":"2026-08-02T20:03:32.798288Z","submitted_at":"2023-06-14T14:44:03Z","title":"MiniLLM: On-Policy Distillation of Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08543","snapshot_observed_at":"2026-08-06T15:42:59.743747Z","title":"MiniLLM: knowledge distillation of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.743747Z"},"links":{"cited_paper":"/paper/2306.08543","citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:aaf56da54df6975141d5f8a98dc5d5f00acf9a0deaaa096bc08e3c7313fa7def","observation_id":"aabe0523-5579-4c2c-a6d6-b5561dc339ff","resolution":{"observed_at":"2026-08-06T15:42:59.743747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-02T17:17:56.296462Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-06T15:42:59.747227Z","title":"A survey on knowledge distillation of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.747227Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:f9d56203f180e7f69434b872f2e75af91c5e8c8f011332082db960231584ea22","observation_id":"5392c55c-035a-41ef-b384-6747ddd66d69","resolution":{"observed_at":"2026-08-06T15:42:59.747227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.977141Z","title":"Survey on knowledge distillation for large language models: methods, evaluation, and application,","venue":null,"work_id":"28c8df7b-ce09-4002-ab70-586b1d75e036","year":2024},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.750252Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:d52ccc648f6fe90a2a27f6826945c96a277dc50b622411bf472607a385954c4b","observation_id":"151ae9ec-f691-4caf-a134-eb094fe66db1","resolution":{"observed_at":"2026-08-06T15:42:59.979806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.971215Z","title":"Compact language models via pruning and knowledge distillation,","venue":null,"work_id":"3c03fc08-a13b-44d2-89c3-95f987ca455e","year":2024},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.752954Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:706fbf12bdbafbbdfb67fbfbb6835655d435c3b1536b485a5767ef0805458900","observation_id":"128daac1-eef3-4a21-8334-7be40932c032","resolution":{"observed_at":"2026-08-06T15:42:59.973478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.964627Z","title":"DDK: distilling domain knowledge for efficient large language models,","venue":null,"work_id":"94d20c39-5ba3-42ae-a8e5-ef9adcf323e9","year":2024},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.755481Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:94ad12f4560b110571d526c21fc090e62623ce21cdfc2d5c7f0437fe1e8f72b6","observation_id":"d5562874-c192-42c6-90be-ea7aa96b1aac","resolution":{"observed_at":"2026-08-06T15:42:59.966804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.958325Z","title":"Multi granularity structural knowledge distillation for language model compression,","venue":null,"work_id":"80086144-3751-4968-b4c8-c153c5cd7f09","year":2022},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.757556Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:51f35164c62db35170852f5cce07279845a34226dd5e9c470e55cf28611959a4","observation_id":"3a587bfb-e1dd-4d65-bbbb-24c1a3f8f89d","resolution":{"observed_at":"2026-08-06T15:42:59.961037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11295","last_updated":"2021-09-23T11:02:24Z","snapshot_observed_at":"2026-08-09T11:47:25.385234Z","submitted_at":"2021-09-23T11:02:24Z","title":"Dynamic Knowledge Distillation for Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11295","snapshot_observed_at":"2026-08-06T15:42:59.759535Z","title":"Dynamic knowledge distillation for pre trained language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.759535Z"},"links":{"cited_paper":"/paper/2109.11295","citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:5843dfc95cc32179470ea88a3439762734918f4c5c3d6e0fa81005adbd653649","observation_id":"bb6883f3-31e2-42cb-b42b-06eb14afcb29","resolution":{"observed_at":"2026-08-06T15:42:59.759535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.951421Z","title":"Efficient compression of large language models with distillation and fine tuning,","venue":null,"work_id":"77dca5b8-f125-4b88-9e14-7f1e0a385467","year":2023},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.761991Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:f65323de0b646f21e478080623c932b22ba66fa5fb1fc21def05674749b68704","observation_id":"0e9380e1-589f-4b78-94de-03739a5d220c","resolution":{"observed_at":"2026-08-06T15:42:59.953495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00726","last_updated":"2025-05-31T21:59:01Z","snapshot_observed_at":"2026-08-07T11:57:06.911958Z","submitted_at":"2025-05-31T21:59:01Z","title":"Structured Gradient Guidance for Few-Shot Adaptation in Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.00726","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00726","snapshot_observed_at":"2026-08-06T15:42:59.858779Z","title":"Structured Gradient Guidance for Few-Shot Adaptation in Large Language Models","venue":"cs.CL","work_id":"eab7a25e-f4dc-4d81-b9cc-bb081c6ce834","year":2025},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.763633Z"},"links":{"cited_paper":"/paper/2506.00726","citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:6bddeee03b09b2bd8163a2ba91d8adf4533963a9a65e1f2846baf556d931339b","observation_id":"6b558dae-9c22-4529-bc37-76fcd5a0e882","resolution":{"observed_at":"2026-08-06T15:42:59.861454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.945712Z","title":"Structuring low-rank adaptation with semantic guidance for model fine-tuning,","venue":null,"work_id":"d262bd4f-020a-4214-9aba-5d7f5d7e3d7f","year":2025},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.765655Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:87b3056ea67aec97cdc836aec45c8dd298420b2dfe348eb5498abe9b033bb246","observation_id":"876bdbfd-9523-43da-908f-a229350a547f","resolution":{"observed_at":"2026-08-06T15:42:59.947900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.939831Z","title":"Integrating knowledge graph reasoning with pretrained language models for structured anomaly detection,","venue":null,"work_id":"655caf69-6e20-4de0-b78c-137ef6ee264c","year":2025},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.767252Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:47eb01858cda2a6b526b2548aff7307ecf5f0d4fbd8305e9f49be6efc7fb0388","observation_id":"c557cfa3-d4f3-49fa-983a-c79a9dc564de","resolution":{"observed_at":"2026-08-06T15:42:59.941991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22921","last_updated":"2025-05-28T22:49:04Z","snapshot_observed_at":"2026-08-07T12:55:09.605273Z","submitted_at":"2025-05-28T22:49:04Z","title":"Structured Memory Mechanisms for Stable Context Representation in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22921","snapshot_observed_at":"2026-08-06T15:42:59.768952Z","title":"Structured memory mechanisms for stable context representation in large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.768952Z"},"links":{"cited_paper":"/paper/2505.22921","citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:3fa091a3e322890e1b3e21b206d1bd801113426676ff478a7337e0f78c223675","observation_id":"b5e7f2c6-9246-4bf1-9ce8-ed1c6f08165b","resolution":{"observed_at":"2026-08-06T15:42:59.768952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.934182Z","title":"Structured knowledge integration and memory modeling in large language systems,","venue":null,"work_id":"799e549f-3407-46fe-a1d6-223a74b6f36e","year":2024},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.771834Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:b8b564f428c8b458372071e282034a8dd0f90ac14553338e161f41055379ad7b","observation_id":"0d329dd3-cfbc-4d89-add2-88dabe0e9263","resolution":{"observed_at":"2026-08-06T15:42:59.936268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.926849Z","title":"Time-aware and multi-source feature fusion for transformer-based medical text analysis,","venue":null,"work_id":"16951e86-b06c-479b-a834-0e03c5f22533","year":2024},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.773668Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:62d402f08dc2845c12e7ed8509c234951c59405b240e9cb6bbb2a3e513e48a91","observation_id":"bc3537fa-36a8-4fa6-ac4e-0a057f2eec63","resolution":{"observed_at":"2026-08-06T15:42:59.929348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.920332Z","title":"Structured preference modeling for reinforcement learning-based fine-tuning of large models,","venue":null,"work_id":"947faafa-3ff3-453e-a471-5c48faadff75","year":2025},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.775280Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:d4b19c44a898dc8bf16a624ba005de58c24a67a8f6ba0959edb31d770b112965","observation_id":"e2358702-3052-4113-a87e-5a53df2b4edb","resolution":{"observed_at":"2026-08-06T15:42:59.922985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19583","last_updated":"2025-06-01T22:38:52Z","snapshot_observed_at":"2026-08-07T15:58:40.814740Z","submitted_at":"2025-04-28T08:42:35Z","title":"Graph-Based Spectral Decomposition for Parameter Coordination in Language Model Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2504.19583","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.19583","snapshot_observed_at":"2026-08-06T15:42:59.844843Z","title":"Graph-Based Spectral Decomposition for Parameter Coordination in Language Model Fine-Tuning","venue":"cs.LG","work_id":"5891abae-be45-42ff-9fd9-46327adcfa49","year":2025},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.777240Z"},"links":{"cited_paper":"/paper/2504.19583","citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:8cf8479700deac7cf8df507383edd32c31dce46184aa1f9cc91c18362e7704af","observation_id":"d6213767-45e5-4d10-a817-7ad1534f0e91","resolution":{"observed_at":"2026-08-06T15:42:59.847183Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19436","last_updated":"2025-04-28T02:50:45Z","snapshot_observed_at":"2026-08-07T15:58:44.807381Z","submitted_at":"2025-04-28T02:50:45Z","title":"Context-Guided Dynamic Retrieval for Improving Generation Quality in RAG Models","version":1},"cited_work":{"arxiv_id":"2504.19436","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.19436","snapshot_observed_at":"2026-08-06T15:42:59.834306Z","title":"Context-Guided Dynamic Retrieval for Improving Generation Quality in RAG Models","venue":"cs.CL","work_id":"dfc4ba19-4de9-4d45-a692-2759770819ad","year":2025},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.779466Z"},"links":{"cited_paper":"/paper/2504.19436","citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:dc66f058b30b0dba779978317aab53d6a5bbb434741fe1239068a80e0232f0c6","observation_id":"82e9ed15-bd0f-4514-932f-99007d8dd93f","resolution":{"observed_at":"2026-08-06T15:42:59.838249Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.914058Z","title":"Context-aligned and evidence-based detection of hallucinations in large language model outputs,","venue":null,"work_id":"b6e6c026-615c-4e7d-b9ca-c23c5d3bfcf8","year":2025},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.781424Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:5515507061538847cedca6039688d5a9756c173eff787c725c2f83c836f37d4c","observation_id":"da23d263-6bca-4ec1-a518-f787434912b0","resolution":{"observed_at":"2026-08-06T15:42:59.916735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.906351Z","title":"Transfer methods for large language models in low-resource text generation tasks,","venue":null,"work_id":"0583706c-924c-4383-8bd1-313ea7c89cdf","year":2024},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.783104Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:24b3d6009851e905d373d5fba28bab7f6e8f26783c358f0c8d21d9abd94ccd5a","observation_id":"44f895e1-cdad-4e44-84f2-9897e592aaa6","resolution":{"observed_at":"2026-08-06T15:42:59.908847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00282","last_updated":"2025-03-31T23:04:45Z","snapshot_observed_at":"2026-08-07T16:19:02.281831Z","submitted_at":"2025-03-31T23:04:45Z","title":"Federated Learning for Cross-Domain Data Privacy: A Distributed Approach to Secure Collaboration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00282","snapshot_observed_at":"2026-08-06T15:42:59.784969Z","title":"Joint semantic detection and dissemination control of phishing attacks on social media via LLama-based modeling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.784969Z"},"links":{"cited_paper":"/paper/2504.00282","citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:4bca7c15f764a0887fc709b8d1534e9842cb24173aae5b22f26a195bd83b5f7d","observation_id":"5c11e94a-8f11-432a-beb2-bb04710a011e","resolution":{"observed_at":"2026-08-06T15:42:59.784969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.900489Z","title":"Perception-guided structural framework for large language model design,","venue":null,"work_id":"0f37d19f-2b26-4280-9fc8-38788ccd8319","year":2025},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.786801Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:37d191c473e96ce6c1fb08a0332199ab29fe4d2bd1a38c8597c38b3e982efe66","observation_id":"7e6a0827-24e7-4dc6-ae91-3982066bbb7b","resolution":{"observed_at":"2026-08-06T15:42:59.902495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.893849Z","title":"A deep learning-based predictive framework for backend latency using AI-augmented structured modeling,","venue":null,"work_id":"69f07971-ab6c-4767-98a8-7195ff52458a","year":2024},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.788371Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:cab3feea263e642dafe9c7d8a527d492fc76ec298c6cda0ec724ca3a0bbf8df3","observation_id":"5290e5fc-e5ae-4ded-9064-19de3cfe8ccc","resolution":{"observed_at":"2026-08-06T15:42:59.896507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-06T15:42:59.790511Z","title":"TinyBERT: distilling BERT for natural language understanding,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.790511Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:a25ebc06fbd63c5c7a0d2e805962e901e70b24e8af24714b5b0ed886547f0116","observation_id":"f213d2be-3a68-4035-8326-733f47f762ef","resolution":{"observed_at":"2026-08-06T15:42:59.790511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.02984","last_updated":"2020-04-14T23:54:36Z","snapshot_observed_at":"2026-08-06T09:03:09.275283Z","submitted_at":"2020-04-06T20:20:58Z","title":"MobileBERT: a Compact Task-Agnostic BERT for Resource-Limited Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.02984","snapshot_observed_at":"2026-08-06T15:42:59.793265Z","title":"MobileBERT: a compact task-agnostic BERT for resource-limited devices,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.793265Z"},"links":{"cited_paper":"/paper/2004.02984","citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:413e27ebd59b977eb5bf64de201e5d835a35eefa39ff3900e85070e85b62496f","observation_id":"59cbeb65-13c7-415c-bf99-304e7647a72b","resolution":{"observed_at":"2026-08-06T15:42:59.793265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.887228Z","title":"MiniLM: deep self-attention distillation for task-agnostic compression of pre-trained transformers,","venue":null,"work_id":"c6ba9f03-548a-45e1-a823-5851c8910a34","year":2020},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.795578Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:6d890c64b03fb7574fdd2b6ff35fe87311d5dcd0c72f65317797c62d462aabd0","observation_id":"c0c4dd01-c782-4ed3-b868-8fb1a547098d","resolution":{"observed_at":"2026-08-06T15:42:59.889835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:59.881468Z","title":"Decoupled knowledge distillation,","venue":null,"work_id":"0698f535-44b1-4d04-9109-bf95e54fed93","year":2022},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.797684Z"},"links":{"citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:08f7c96f90f15a51bb638f1d9f222ce9c2403855a0314d3f10aba1c207047fc3","observation_id":"fc3cf48f-ddce-4360-b5fd-b4698528546c","resolution":{"observed_at":"2026-08-06T15:42:59.883480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":3,"verified_fuzzy":16},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 3 inbound Pith citation observations for arXiv:2507.15198."}