{"as_of":"2026-08-07T17:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:748534f21f9c1bf7be2c42a633375f05b66f0c4023380085e95d2c01ceb1e8ad","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T19:31:39.052107Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.12590/citation-record","integrity":"/paper/2508.12590/integrity","json":"/paper/2508.12590/citation-record.json","paper":"/paper/2508.12590"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:31:39.457320Z","title":"Harnessing the power of llms in practice: A survey on chatgpt and beyond,","venue":null,"work_id":"664d053d-2980-4dcc-aaa7-40ef75d2a12e","year":2024},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.002774Z"},"links":{"citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:daec3a113a78a17aacf5af9dd7bc2e80b932652e785fc5e66466bd0b6f1e678d","observation_id":"13ffb03c-64ba-4c7f-8177-5843e13104ef","resolution":{"observed_at":"2026-08-05T19:31:39.461160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16739","last_updated":"2025-06-04T07:22:47Z","snapshot_observed_at":"2026-08-03T22:38:00.596602Z","submitted_at":"2023-09-28T06:22:59Z","title":"Pushing Large Language Models to the 6G Edge: Vision, Challenges, and Opportunities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16739","snapshot_observed_at":"2026-08-05T19:31:39.005967Z","title":"Pushing large language models to the 6g edge: Vision, challenges, and oppor- tunities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.005967Z"},"links":{"cited_paper":"/paper/2309.16739","citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:95d14ffc9f9051201de2e9989c3e45d21bcc10e4faadb8e954a1c696834e8a6c","observation_id":"e68eeda1-f9d8-4850-a7e5-c2f12fb57fdd","resolution":{"observed_at":"2026-08-05T19:31:39.005967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:31:39.447946Z","title":"Hybrid slm and llm for edge-cloud collaborative inference,","venue":null,"work_id":"d09d22e7-abd3-46f8-8f0f-fe1e0120fd9d","year":2024},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.009391Z"},"links":{"citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:3d944f75def3286c2d5fdc90b46c2635db51e2d569fa4bec60c0701c49bb1a31","observation_id":"90689d9d-85e8-4f72-83f0-02512697cc30","resolution":{"observed_at":"2026-08-05T19:31:39.451366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:31:39.438499Z","title":"Fast inference from trans- formers via speculative decoding,","venue":null,"work_id":"6570f4d2-b8d2-4b47-96fb-e284481b8e95","year":2023},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.012982Z"},"links":{"citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:75dfa3b1a4c7252f9ac10a235c54ced6d843e90224829826d3ed3cbf669fcdbf","observation_id":"fbdc6fd9-d6e9-4907-ab36-08da220991de","resolution":{"observed_at":"2026-08-05T19:31:39.441705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08461","last_updated":"2024-03-31T03:06:51Z","snapshot_observed_at":"2026-08-06T22:36:42.010627Z","submitted_at":"2023-10-12T16:21:04Z","title":"DistillSpec: Improving Speculative Decoding via Knowledge Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08461","snapshot_observed_at":"2026-08-05T19:31:39.016413Z","title":"Distillspec: Improving speculative decoding via knowledge distillation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.016413Z"},"links":{"cited_paper":"/paper/2310.08461","citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:e5be733b058efa9b618c4c062d795fee3ef18965904a766c19a7776bdc05277a","observation_id":"81bbfd8e-ab94-4f7e-8c4a-830767f993fe","resolution":{"observed_at":"2026-08-05T19:31:39.016413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:31:39.424740Z","title":"Uncertainty-aware hybrid inference with on-device small and remote large language models,","venue":null,"work_id":"66eccfe1-9a58-4212-8b93-30a864f919a3","year":2025},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.019737Z"},"links":{"citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:ea16214401e939781620ddbfc3085abf371a60d5b62e77cb1c5c5dc850153b6c","observation_id":"4d0d7295-cda8-4254-a264-dfb25f134a61","resolution":{"observed_at":"2026-08-05T19:31:39.431631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:31:39.407214Z","title":"Uncertainty-aware opportunistic hybrid language model in wireless robotic systems,","venue":null,"work_id":"cfb43374-404c-4041-ac34-c259dd418b3f","year":2025},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.022856Z"},"links":{"citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:5395eedc2efc50730ab5e562c8d843040d9318b8d2929e723e70e57d71d98c11","observation_id":"dbfd4561-579e-4f76-b464-79dd46aef187","resolution":{"observed_at":"2026-08-05T19:31:39.411228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:31:39.389792Z","title":"Seeing far and clearly: Mitigating halluci- nations in mllms with attention causal decoding,","venue":null,"work_id":"5714f76f-b901-436c-9741-abd201fe2620","year":2025},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.025859Z"},"links":{"citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:d71e84be6cef6ba0081c88382489b09b10e2edfdec1252e0fc2298741e22c05d","observation_id":"f0b85060-eb4e-4bc8-9d85-93284ee55516","resolution":{"observed_at":"2026-08-05T19:31:39.397924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:31:39.373047Z","title":"Understanding the metropolis-hastings algorithm,","venue":null,"work_id":"8140f3eb-60c0-426f-8449-caa3d9134fac","year":1995},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.028602Z"},"links":{"citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:839ec98bd7e8f97aa6dfc6574ce470fd0f610038b8b64db8cc5881f6fd5894fe","observation_id":"3c9b5960-3ac4-42fd-9706-84f200110ca4","resolution":{"observed_at":"2026-08-05T19:31:39.378874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12335","last_updated":"2024-10-02T00:19:13Z","snapshot_observed_at":"2026-08-05T13:25:45.819642Z","submitted_at":"2024-06-18T07:01:11Z","title":"Attention Score is not All You Need for Token Importance Indicator in KV Cache Reduction: Value Also Matters","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12335","snapshot_observed_at":"2026-08-05T19:31:39.031313Z","title":"Attention score is not all you need for token importance indicator in kv cache reduction: Value also matters,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.031313Z"},"links":{"cited_paper":"/paper/2406.12335","citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:c1cde36e8cd3e66715be90f765e73ee74e13bd423281006c7c77ba6f46981144","observation_id":"130c4ab6-96f5-4c1c-a11f-e393be730b73","resolution":{"observed_at":"2026-08-05T19:31:39.031313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:31:39.305555Z","title":"Latte: Low-precision approximate attention with head-wise trainable threshold for efficient transformer,","venue":null,"work_id":"a38565d6-cf2e-45fc-b23d-b339b5b5ebd8","year":2024},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.034625Z"},"links":{"citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:61a770c316502a863d17efe4bc0fbb3433d0a7ae2a339291e307c8ba6c83a5e8","observation_id":"9b3dc1b0-98b5-458e-a22b-c7ebd21d54ec","resolution":{"observed_at":"2026-08-05T19:31:39.341197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:31:39.220273Z","title":"Energon: Toward efficient acceleration of transformers using dynamic sparse attention,","venue":null,"work_id":"0ccf5dd1-7886-4473-9fd0-5771215618e5","year":2022},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.037367Z"},"links":{"citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:d1759efad42c33317b91514e0e7914b909799aba092f6d29f59108b813c7c9e4","observation_id":"afd689fe-6809-4571-98fd-d42752e95ac7","resolution":{"observed_at":"2026-08-05T19:31:39.259478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-05T19:31:39.039834Z","title":"Tinyllama: An open-source small language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.039834Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:5a911a19755e8ffa1dd11ab2b390b45b84b2e7dc5d5a725b9b186f651d88604b","observation_id":"fae26586-119d-4841-ba5f-6bd02c280899","resolution":{"observed_at":"2026-08-05T19:31:39.039834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T19:31:39.043735Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.043735Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:db63fe11d9b587e101b133943b76d22109cd7823519e27eb2fe8043131605d0b","observation_id":"079bf107-d6d2-426b-9f3b-5d8852fbc3a6","resolution":{"observed_at":"2026-08-05T19:31:39.043735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:31:39.046483Z","title":"Stanford alpaca: An instruction-following llama model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.046483Z"},"links":{"citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:8c17bd32571b8d24b9064983c71c9a166f417b4fe09ab9f8cb8a7ad7c091e65b","observation_id":"966da510-63e7-4b40-a262-12ba3c6448d5","resolution":{"observed_at":"2026-08-05T19:31:39.046483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-05T19:31:39.049209Z","title":"Bertscore: Evaluating text generation with bert,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.049209Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:1f1f56b92ad7ceee9c2924b8e5c8d92a4c5a29bf43bbd70b159cbf8d7c7e912d","observation_id":"ff3167e8-2ec7-4f99-bb73-feafd452aaf7","resolution":{"observed_at":"2026-08-05T19:31:39.049209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:31:39.128108Z","title":"Joint computation and communication cooperation for energy-efficient mobile edge comput- ing,","venue":null,"work_id":"1ad96ff9-d9a0-4ae7-a5f4-d54121f5216e","year":2018},"citing_paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T19:31:39.052107Z"},"links":{"citing_paper":"/paper/2508.12590"},"observation_digest":"sha256:581773f09cbae9d482543ebd8ea6743074296cd1687a38c4dc14d4c788203272","observation_id":"36761e8f-6eb2-4193-8387-555625992248","resolution":{"observed_at":"2026-08-05T19:31:39.162658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.12590","last_updated":"2025-08-18T02:56:59Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T06:36:33.963081Z","submitted_at":"2025-08-18T02:56:59Z","title":"Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2508.12590."}