{"as_of":"2026-08-08T21:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1d4a988c2610e0779733f139f2532a3f509a2b4eedfa84e11807cdb1bd183276","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T01:10:01.889411Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.10431/citation-record","integrity":"/paper/2602.10431/integrity","json":"/paper/2602.10431/citation-record.json","paper":"/paper/2602.10431"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:10:01.889411Z","title":"Table 13.Execution Ratio and threshold results for LLaMA2-7B Layer CSQA Bits Execution PIQA BoolQ SIQA ARCe ARCc Winogr","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:01.889411Z"},"links":{"citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:4ac65f654414d96f20d7368a07a2a0c0a6469c3a73dd86278be3f65dc990851d","observation_id":"189626e3-626f-4219-b01f-3f530f891696","resolution":{"observed_at":"2026-08-03T01:10:01.889411Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-03T01:10:00.051255Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:00.051255Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:2fd9c9be767c14f42af1097663c4654c339e91e69f6852ffb3484d77dac74f4f","observation_id":"ebedfd77-61c2-4f38-b2fa-4839a843bb09","resolution":{"observed_at":"2026-08-03T01:10:00.051255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:10:00.420590Z","title":"Diffskip: Differential layer skipping in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:00.420590Z"},"links":{"citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:14f312a7d27c084294e36f987dfa8f538ea785fe4fb1bc3a4600cdc6626396f1","observation_id":"96f307ce-9c26-403d-a3e6-bdf56fed6a96","resolution":{"observed_at":"2026-08-03T01:10:00.420590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:10:00.552555Z","title":"Bayesian Optimization: Open source constrained global optimization tool for Python, 2014–","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:00.552555Z"},"links":{"citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:6e7d9023c6b79e7a2f7927af8284bafe3d6dd12c4008528beeca98f8a40893fa","observation_id":"570d3115-7e5e-4515-9b33-c714a60fcead","resolution":{"observed_at":"2026-08-03T01:10:00.552555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:10:01.718466Z","title":"Compared to QTALE, structured pruning provides better memory efficiency because redundant layers are removed entirely","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:01.718466Z"},"links":{"citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:173a06a72095d6f0a51c1b7f8d5580ce622e6db90b31b7e4fe1a02155963203a","observation_id":"69e51996-ac64-4924-a9f6-469c55b5e0ee","resolution":{"observed_at":"2026-08-03T01:10:01.718466Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:10:00.851512Z","title":"Dropout: a simple way to prevent neural networks from overfitting.The journal of machine learning research, 15(1):1929–1958,","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:00.851512Z"},"links":{"citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:94dc49d22dbbac8b16eaf1268181d9f72530c3037702b05f8c9ca12ddbf54e20","observation_id":"7b24ac29-383e-475c-a7c2-2bcbb635c621","resolution":{"observed_at":"2026-08-03T01:10:00.851512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-03T01:10:01.002656Z","title":"Llama 2: Open foundation and fine- tuned chat models.arXiv preprint arXiv:2307.09288,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:01.002656Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:90b85270b32594410d8735de99c0d0176a4ab167bc22a7c60fe75983324cb0fe","observation_id":"137591b0-1f4c-4330-a3b5-3e24df962f63","resolution":{"observed_at":"2026-08-03T01:10:01.002656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-03T01:10:01.208569Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:01.208569Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:98fbf1a38db820f5da2494bee00c3f860c50de1aec901d34e7b7a036238fc1b7","observation_id":"b02cc9e9-a320-45b0-8a9a-c75ac17676d8","resolution":{"observed_at":"2026-08-03T01:10:01.208569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-03T01:10:01.386927Z","title":"V ., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:01.386927Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:21f00afe51d402f955d38593020eff401986214e03efd483000578e00652082d","observation_id":"e54c6126-01c7-4758-bae2-16ad5c902b93","resolution":{"observed_at":"2026-08-03T01:10:01.386927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:10:01.561370Z","title":"The dashed line indicates the trend line","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:01.561370Z"},"links":{"citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:26c2e02731d6e025911a7c4bd85de25aa9c41f6ca63d0664bc6f810066274dc6","observation_id":"f59be0af-9ced-45b2-9bab-88ada9fa19c1","resolution":{"observed_at":"2026-08-03T01:10:01.561370Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:10:01.831301Z","title":"As shown in Table 11, even under these demanding conditions, QTALE consistently provides stronger quantization robustness compared to D-LLM","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:01.831301Z"},"links":{"citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:8eff75150e9703f499aa21ed0ee1249d8d97b54b54c3ab4d0f497cbff16c3ff4","observation_id":"34f8a773-1b07-4cbf-acbe-a5c06228b9a5","resolution":{"observed_at":"2026-08-03T01:10:01.831301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03865","last_updated":"2024-04-05T02:35:43Z","snapshot_observed_at":"2026-07-06T17:55:57.562339Z","submitted_at":"2024-04-05T02:35:43Z","title":"FFN-SkipLLM: A Hidden Gem for Autoregressive Decoding with Adaptive Feed Forward Skipping","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03865","snapshot_observed_at":"2026-08-03T01:10:00.287006Z","title":"Ffn-skipllm: A hidden gem for autoregressive decoding with adaptive feed forward skipping.arXiv preprint arXiv:2404.03865,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:00.287006Z"},"links":{"cited_paper":"/paper/2404.03865","citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:95e6308911203987f30b92c2fb28d4b1daba933ee6cfd82f5a6da078f20af11e","observation_id":"d48f9557-afd7-4392-917a-4745206b7e9e","resolution":{"observed_at":"2026-08-03T01:10:00.287006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02628","last_updated":"2023-07-05T19:59:09Z","snapshot_observed_at":"2026-07-06T15:50:49.116859Z","submitted_at":"2023-07-05T19:59:09Z","title":"SkipDecode: Autoregressive Skip Decoding with Batching and Caching for Efficient LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02628","snapshot_observed_at":"2026-08-03T01:09:59.784748Z","title":"Skipdecode: Autoregressive skip decoding with batching and caching for efficient llm inference.arXiv preprint arXiv:2307.02628,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-03T01:09:59.784748Z"},"links":{"cited_paper":"/paper/2307.02628","citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:1f1fb08bc30298bef98f5a7b54381da11c57b8cd0f7846d9f72a1216a4f4d1f6","observation_id":"f9d686ef-61f8-41bd-9c6d-53bf6b1067af","resolution":{"observed_at":"2026-08-03T01:09:59.784748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-03T01:09:59.650638Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-03T01:09:59.650638Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:7396cd354838c6df58df9833250c8b570ac6ac0b55d02b72cede054bcd70dbf1","observation_id":"4aa0d380-7b66-4292-81ac-28e41fb7212f","resolution":{"observed_at":"2026-08-03T01:09:59.650638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-07-06T07:55:12.121264Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-03T01:09:59.542418Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions.arXiv preprint arXiv:1905.10044,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-03T01:09:59.542418Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:3f2de853ec64fe9cc5ae382527dffc3e7b6e942c9e19b702a61decbc83bed6a9","observation_id":"9f9e2749-9eb1-4098-a98c-af2be8b89df7","resolution":{"observed_at":"2026-08-03T01:09:59.542418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09728","last_updated":"2019-09-09T17:29:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-04-22T05:36:37Z","title":"SocialIQA: Commonsense Reasoning about Social Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09728","snapshot_observed_at":"2026-08-03T01:10:00.713286Z","title":"Socialiqa: Commonsense reasoning about social interac- tions.arXiv preprint arXiv:1904.09728,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:00.713286Z"},"links":{"cited_paper":"/paper/1904.09728","citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:8ac1e813e86f84be10867755a61ec71309313b7d0f08fefa076ffe529a5bb8ff","observation_id":"9ed4adc5-c9cd-4fb7-bbe0-6557e7402923","resolution":{"observed_at":"2026-08-03T01:10:00.713286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:10:01.492840Z","title":"Appendix A.1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:01.492840Z"},"links":{"citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:8c3d0bc855138282b7c5d02ad243e8e1b5492aa5f174aafbcfd63e6f90de1cdb","observation_id":"8cc00bc8-0130-4489-a8b3-f6cc33c6276a","resolution":{"observed_at":"2026-08-03T01:10:01.492840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-03T01:09:59.925845Z","title":"Gptq: Accurate post-training quantization for generative pre- trained transformers.arXiv preprint arXiv:2210.17323,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T01:09:59.925845Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:e20041168c4e0785beb5392e66ff3f61d3b09500810544bf2a941d9634d2ae9a","observation_id":"6987f4af-12b5-4d0c-b06b-04618912e65c","resolution":{"observed_at":"2026-08-03T01:09:59.925845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02336","last_updated":"2025-01-04T17:01:30Z","snapshot_observed_at":"2026-07-06T20:16:35.984578Z","submitted_at":"2025-01-04T17:01:30Z","title":"AdaSkip: Adaptive Sublayer Skipping for Accelerating Long-Context LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02336","snapshot_observed_at":"2026-08-03T01:10:00.166572Z","title":"Adaskip: Adaptive sublayer skipping for ac- celerating long-context llm inference.arXiv preprint arXiv:2501.02336,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T01:10:00.166572Z"},"links":{"cited_paper":"/paper/2501.02336","citing_paper":"/paper/2602.10431"},"observation_digest":"sha256:002529959bb195a60af069c49f86a65ee248bdc6cb8e87482001127edc609c08","observation_id":"3e695c57-6c7f-4887-8a3e-0044a15c9bc9","resolution":{"observed_at":"2026-08-03T01:10:00.166572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.10431","last_updated":"2026-07-02T02:57:57Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T01:06:16.035971Z","submitted_at":"2026-02-11T02:19:11Z","title":"QTALE: Quantization-Robust Token-Adaptive Layer Execution for LLMs"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2602.10431."}