{"as_of":"2026-08-17T15:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0d1c4376f529455754dc80f625c832ab5e766411ea5d5811530ca199ea1889cd","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T11:18:55.938657Z","state":"measured"},{"denominator":78,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":78,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.13426/citation-record","integrity":"/paper/2608.13426/integrity","json":"/paper/2608.13426/citation-record.json","paper":"/paper/2608.13426"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.280957Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.280957Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:0b955249ba1374885d56cad917f14d7aac7e05f0fc38865905c31be90d112de3","observation_id":"69fea43f-d71c-4f69-baad-092342a7539b","resolution":{"observed_at":"2026-08-14T11:18:55.280957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.289865Z","title":"2021 , howpublished=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.289865Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:8f0e90afe86035f1b82a218bf9cdaa12dcadfaa5fbe6d1c294ca49d6ad0084c0","observation_id":"d6fae252-c0ee-4f92-907c-f8134586d2f7","resolution":{"observed_at":"2026-08-14T11:18:55.289865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.315399Z","title":"2020 , eprint=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.315399Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:20b8bc3c3287680df7b1b8b912ff52e03cf3609013014f38c791fc2410331b94","observation_id":"4691e197-00b0-4ee0-8ded-b841d0db8158","resolution":{"observed_at":"2026-08-14T11:18:55.315399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:57.739452Z","title":"2023 , eprint=","venue":null,"work_id":"43135514-9ed0-40da-af0b-6aad4c3d59a6","year":2023},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.324138Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:d1d5d6632ad78a7d2ddd775d10c52d319055d39a4f60f8040aea3305a34f6847","observation_id":"98c975f8-d60a-4aba-b30e-18a92239746b","resolution":{"observed_at":"2026-08-14T11:18:57.748706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:57.715712Z","title":"2015 , eprint=","venue":null,"work_id":"cb51067b-80f3-48d2-ad03-58ffe6941aaa","year":2015},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.334955Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:cd2a22654209925172538d2e758fe075861f5246d59d6b53dc0da1ad5d38ab59","observation_id":"1ee66d48-019c-4fd3-817d-2356fad1a6f9","resolution":{"observed_at":"2026-08-14T11:18:57.724967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:57.690191Z","title":"2023 , eprint=","venue":null,"work_id":"b5e0fada-1d51-47a2-b64f-60505f11320b","year":2023},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.350313Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:12db4dea6cea5172997492bfb976d862d190eafa8d16d6fd4480c007dd702573","observation_id":"c898c77a-752f-445c-abb1-a47dc3077a1a","resolution":{"observed_at":"2026-08-14T11:18:57.694872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:57.661670Z","title":"2023 , eprint=","venue":null,"work_id":"d6e6f1a4-1cf7-4ead-9dd4-35eec561f1a0","year":2023},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.373375Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:d2efcf27f26ad147c229cedba9e2aac6bcd62674ed2e1844d58611c067f7b548","observation_id":"f8aa7d7c-204d-4b2f-94e0-9675454057d4","resolution":{"observed_at":"2026-08-14T11:18:57.670267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.381382Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.381382Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:4b1fba1d17574b53d9eff0a642c8bc4433fdf8e9abd78ea864798e7810258bfe","observation_id":"ecc267b9-1b07-4be4-85e3-49d5f8577da8","resolution":{"observed_at":"2026-08-14T11:18:55.381382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:57.619830Z","title":"2024 , eprint=","venue":null,"work_id":"5af5dd6e-b948-4fa5-a1cb-9de2f79a3e5c","year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.388047Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:24c078eae39f4fcc5905d6e88b84ff0d99ca4093a30fe271a35cfd22265a6b19","observation_id":"0c7a18f9-00a7-4004-943b-c18fc77179ae","resolution":{"observed_at":"2026-08-14T11:18:57.628122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.401521Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.401521Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:bb1edd95e6b199b87da75439531b1518acbf0cc0a70dc1a62f0429b4cc450ccd","observation_id":"5eadb72c-4a82-4a1b-b74a-20e6d1be94ae","resolution":{"observed_at":"2026-08-14T11:18:55.401521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.415334Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.415334Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:3d6dc66f3067911ca52870eacf873192880c5aeb3f467464a876791881454ba7","observation_id":"83a982d8-5d3a-49e7-8548-5d5edc21311a","resolution":{"observed_at":"2026-08-14T11:18:55.415334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.421537Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.421537Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:d8be76a5b57e789661134cc264ecec899dfc6d68dfec49ffd93feb3e9c00356f","observation_id":"52d35593-21e4-4f67-aa58-f72872ab9d20","resolution":{"observed_at":"2026-08-14T11:18:55.421537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.427719Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.427719Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:b63ff70bd79bbadf71e3e1cbdd6d793529894ac7150eac21793f9f0daf9e8b48","observation_id":"06e5a1b6-8f0f-4613-8822-65102d36334e","resolution":{"observed_at":"2026-08-14T11:18:55.427719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.437682Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.437682Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:9e87f1d39b8ce731d55c3885ae730503c374396028fc900804ba826c164a3554","observation_id":"94bd7883-4dfb-44e9-9a52-7a83c13e356b","resolution":{"observed_at":"2026-08-14T11:18:55.437682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:57.506772Z","title":"2025 , eprint=","venue":null,"work_id":"3de9768d-ddb0-4e86-818f-5a87292e1eee","year":2025},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.453035Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:a61c4a2d6740d45755deddf039f83be563edeccdb0bbeaacca66e10d87a0a8ac","observation_id":"5239bba1-3ca2-4712-8c63-1c59df2e5dae","resolution":{"observed_at":"2026-08-14T11:18:57.512711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.462324Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.462324Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:30af6908360366533915f2feb1df195682a4da25e603a6f769db3b97f57866a2","observation_id":"c0012889-0744-441d-967e-7670a89eef07","resolution":{"observed_at":"2026-08-14T11:18:55.462324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:57.455223Z","title":"2025 , eprint=","venue":null,"work_id":"b25dd665-c8bf-4f22-a2d2-b62425accd1b","year":2025},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.472104Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:7b6f4804077bf32273e324108584ecc308d0c3393b61fa13bf9231d8211e15ff","observation_id":"6cd313b5-81a6-48cb-b448-c40073c994d0","resolution":{"observed_at":"2026-08-14T11:18:57.463638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.481356Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.481356Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:470c416d6f15149ddfb2595b71220144fd66d18094228ab752fcd422a22f3d3e","observation_id":"364ef813-5590-4e5d-aadd-5bc607c25b89","resolution":{"observed_at":"2026-08-14T11:18:55.481356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:57.412203Z","title":"2020 , eprint=","venue":null,"work_id":"fa573973-235b-402d-9462-90879dfac532","year":2020},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.489897Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:f9a70102b3f35f569c823fb991541d45a91d5725605390324fdf0aa1d687d2b4","observation_id":"073069d4-ad76-4a48-9077-3d528d030914","resolution":{"observed_at":"2026-08-14T11:18:57.419932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:57.387802Z","title":"and Kannan, R","venue":null,"work_id":"e7accbf4-0b43-4e6c-9df8-1e2db8fc53c6","year":null},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.496236Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:9c13f9152c2a5bee0a9fb717b2549d7dcfd1552087e4a2747d50b66f61cb6385","observation_id":"9d1b7f9b-4aa3-4c24-b0ac-ba49b6acdf9a","resolution":{"observed_at":"2026-08-14T11:18:57.398046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.506416Z","title":"SIAM Journal on computing , volume=","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.506416Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:0520d2ce8bcc9d7f4755645c136136e7079655641a2d516b13247c32a3f2b1d8","observation_id":"09f7b7a5-01fa-4b04-9169-4639b81f17df","resolution":{"observed_at":"2026-08-14T11:18:55.506416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:57.336810Z","title":"2011 , eprint=","venue":null,"work_id":"7a0c0c72-22c0-45e0-ad63-d67d75cd5b25","year":2011},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.514052Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:4f8ae683f9f3d5a82267ea1e47f60a9d38e908120a762b2384c6e2d8345bb080","observation_id":"a7e0ac65-9aca-4ab7-9708-c01ab42399a8","resolution":{"observed_at":"2026-08-14T11:18:57.342891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.521203Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.521203Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:713abf2f5226f06cfcd6a310878e26106cfd9324d15ca203d53f38c83853f090","observation_id":"5aa365d4-febc-4acf-a200-f16050956586","resolution":{"observed_at":"2026-08-14T11:18:55.521203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.527858Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.527858Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:c5d91beff20a44aad85fe93e7189a572b92619eade1f2b011dd4c788a4489231","observation_id":"f7259b13-fe64-4a58-a409-a84d60f687f6","resolution":{"observed_at":"2026-08-14T11:18:55.527858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.534734Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.534734Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:61c6e08cb65dfe735ab63c90cbe482c9b54d804db7daee931483a9a2f151d5f0","observation_id":"a9805b73-350a-48e8-a620-2406b9416949","resolution":{"observed_at":"2026-08-14T11:18:55.534734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.541890Z","title":"S em E val-2012 Task 7: Choice of Plausible Alternatives: An Evaluation of Commonsense Causal Reasoning","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.541890Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:63128c23181e100eddc2c4ab1bb94d3e11e0ecb9f55099728b3fafa6f702f5f4","observation_id":"60294c27-ef22-4774-a18b-aaa549822181","resolution":{"observed_at":"2026-08-14T11:18:55.541890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.549094Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.549094Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:3423626a45d1a6ff37edc96c0879cfb27d5533c164e88646b321f058060ef076","observation_id":"b017263f-2551-4a93-9bd4-ebe2d17cc9bd","resolution":{"observed_at":"2026-08-14T11:18:55.549094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.556969Z","title":"2018 , eprint=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.556969Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:420459366c6218cb72f5b2641e368c61923883353520a97cbb978a28ff580a18","observation_id":"2cbe9dc9-1bfd-4dfd-bfd4-39982f4be80f","resolution":{"observed_at":"2026-08-14T11:18:55.556969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.567496Z","title":"2019 , eprint=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.567496Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:1b1586107f32b473fa22d70a32fd4acb13cff79c52278473ae9672bfb1a9abfd","observation_id":"4f975901-0c1d-4dd8-8e2f-f405cff32fc6","resolution":{"observed_at":"2026-08-14T11:18:55.567496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.575141Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.575141Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:a7cddc7e5fcd1023d2b1c88ab68ff5ca5617f050145f1a03a10762dfba26ef0e","observation_id":"6bb7856e-f23f-496e-aa9e-88ac0545c219","resolution":{"observed_at":"2026-08-14T11:18:55.575141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.584366Z","title":"2016 , eprint=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.584366Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:7a7865280b4e5a09a609f463b5144d1be1107c26f1e3fdadecf4bec02f60b223","observation_id":"2a978c4a-6171-4bc1-80f7-28c6bc2b576e","resolution":{"observed_at":"2026-08-14T11:18:55.584366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.591238Z","title":"Proceedings of the IEEE international conference on computer vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.591238Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:be15f2ad33cb71c5949e8efa3655004f793468f97c4a2fab2d0a64714b9248a4","observation_id":"7fc3740d-189d-4ab4-8237-e84c04f3d497","resolution":{"observed_at":"2026-08-14T11:18:55.591238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.598192Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.598192Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:bfa9646f1983b2db2eddf8eb5a7d93207076c5f1b180d0086f687d96689a7b36","observation_id":"bc1484f9-c164-4f26-acc6-0e602c139158","resolution":{"observed_at":"2026-08-14T11:18:55.598192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.608184Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.608184Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:2e9b42c1d1e7bcfcf7fc9ea7767a02a012ad07fc4e9eef9cb2facbc7bb5f4ae7","observation_id":"99e922b5-6660-483a-80a5-604c421b59c9","resolution":{"observed_at":"2026-08-14T11:18:55.608184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.615331Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.615331Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:c45885eb88a29ce3361778547708046e8d3c61e3d586c3a7590ca78848edbb75","observation_id":"da818078-76ac-4fa8-8496-4eb5c5531394","resolution":{"observed_at":"2026-08-14T11:18:55.615331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:57.141178Z","title":"2018 , eprint=","venue":null,"work_id":"a109568b-dd63-4785-9aec-eb9ad7250f38","year":2018},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.629782Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:e3fd292b1f28910412a74aed9ffe08a83f6b0ffc78dec74b3c861709ebad4813","observation_id":"82b676d7-b254-4d31-9d56-22653a05d79e","resolution":{"observed_at":"2026-08-14T11:18:57.147636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.638635Z","title":"2020 , eprint=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.638635Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:a95ba3c98a499297f7979719c051591427f11eef5c66741939c52f74fc9b9a78","observation_id":"daee0d28-303d-4ecd-be9a-51109c4378a7","resolution":{"observed_at":"2026-08-14T11:18:55.638635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.645586Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.645586Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:3d56ea53caded7aba54b379c19b57be72051ec8fd2b111ed4b9b17c1cb646743","observation_id":"f0d53222-c0c7-452f-a2d9-a3d9ef0b558d","resolution":{"observed_at":"2026-08-14T11:18:55.645586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.651295Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.651295Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:f00ba63622da3cd7625556291047378a012a952625d11fc0a5609bfed83c1a5a","observation_id":"9a020023-7fb6-40cf-9bd2-05825ec65528","resolution":{"observed_at":"2026-08-14T11:18:55.651295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:57.081023Z","title":"2024 , eprint=","venue":null,"work_id":"b6c7f482-92f2-4723-a59a-5bf091a99612","year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.659886Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:8eb223197be618055a76be16c50df4c62bd510e01d74e4d0c9eca6c9dc1f61b5","observation_id":"011f64bb-89df-4df6-b20b-68d3aa626196","resolution":{"observed_at":"2026-08-14T11:18:57.087646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.665837Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.665837Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:e08bde8abd92bd7905e78521f6d03fe9d1147f43cbfc0f3a81896039b611e7de","observation_id":"9d690d51-a43d-485f-b7f0-27589c6c7843","resolution":{"observed_at":"2026-08-14T11:18:55.665837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15024","last_updated":"2024-02-09T17:59:40Z","snapshot_observed_at":"2026-08-16T14:24:10.346445Z","submitted_at":"2024-01-26T17:35:45Z","title":"SliceGPT: Compress Large Language Models by Deleting Rows and Columns","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15024","snapshot_observed_at":"2026-08-14T11:18:55.672435Z","title":"Croci, Marcelo Gennari do Nascimento, Torsten Hoefler, and James Hensman","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.672435Z"},"links":{"cited_paper":"/paper/2401.15024","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:fd2ce15d31c91a0ce76d109d91db3b2a7816e3204af921869ce21f0d19b658da","observation_id":"36132773-1f6b-45d6-bfa3-44397bb0a9fc","resolution":{"observed_at":"2026-08-14T11:18:55.672435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-14T11:18:55.681236Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.681236Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:ebc5375d3dd49570a564c768a53006520cf7cf287d4c8f027af271b7995a4f54","observation_id":"c5bffa5a-0306-4a9a-a386-fac9ab8e2985","resolution":{"observed_at":"2026-08-14T11:18:55.681236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.686815Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.686815Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:be37bb82437095c23c9b56ce198b6bb021351fd18e13cbc3e37ffb2429ebbeb3","observation_id":"c04b0afc-d362-4d6d-b78c-caed7fc16841","resolution":{"observed_at":"2026-08-14T11:18:55.686815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-14T11:18:55.694939Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.694939Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:b56c713efef9b8cff7e7d460b7183fe470104b81748e7b13bcd437d647a7bc4c","observation_id":"386b1131-e408-4623-8ac9-9bf529e808d3","resolution":{"observed_at":"2026-08-14T11:18:55.694939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-14T11:18:55.705041Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.705041Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:290347293b6350d0c48b0bad63aff2de34732c2b4af8ba6da807887f86f22063","observation_id":"af44ed43-e90a-4323-a969-89bd49e0e9ed","resolution":{"observed_at":"2026-08-14T11:18:55.705041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-14T11:18:55.712656Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.712656Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:5041e3e89c24cb8500c77317e655430048e51320db5e853ccec9a069187f3d32","observation_id":"2d69bf9f-89a7-4753-a6f9-dba710c9dcef","resolution":{"observed_at":"2026-08-14T11:18:55.712656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:57.027857Z","title":null,"venue":null,"work_id":"4cebf51b-131f-439b-9941-a14702ddf84e","year":2006},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.720075Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:e089d05fdfc84f6ab74112418c67a70cb3e4b24ff7ff273994d5c4a4eb89ab2a","observation_id":"fd9cc997-9df3-488c-b58f-a55352897f79","resolution":{"observed_at":"2026-08-14T11:18:57.040864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00774","last_updated":"2023-03-22T12:33:46Z","snapshot_observed_at":"2026-08-16T16:04:50.106378Z","submitted_at":"2023-01-02T17:48:56Z","title":"SparseGPT: Massive Language Models Can Be Accurately Pruned in One-Shot","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00774","snapshot_observed_at":"2026-08-14T11:18:55.729950Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.729950Z"},"links":{"cited_paper":"/paper/2301.00774","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:ee5c4bb54c85e64d010451ddf106476835bae66ff3d37e78603468a9069fb3f2","observation_id":"1cbeb837-0ec5-4cad-a0cd-d38208a8e1d1","resolution":{"observed_at":"2026-08-14T11:18:55.729950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12390","last_updated":"2024-07-03T08:44:45Z","snapshot_observed_at":"2026-08-14T00:50:08.075021Z","submitted_at":"2024-04-18T17:59:54Z","title":"BLINK: Multimodal Large Language Models Can See but Not Perceive","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12390","snapshot_observed_at":"2026-08-14T11:18:55.736796Z","title":"Smith, Wei-Chiu Ma, and Ranjay Krishna","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.736796Z"},"links":{"cited_paper":"/paper/2404.12390","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:63c5eefddd3acf6c9b36f2352d90ae017c7ab11fc08726eaf468c6be1bc9b4ef","observation_id":"0d26a170-55de-42b8-8dd4-d32d44090615","resolution":{"observed_at":"2026-08-14T11:18:55.736796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15260","last_updated":"2025-08-21T05:48:38Z","snapshot_observed_at":"2026-08-12T17:10:09.978771Z","submitted_at":"2025-08-21T05:48:38Z","title":"Deep Think with Confidence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15260","snapshot_observed_at":"2026-08-14T11:18:55.744511Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.744511Z"},"links":{"cited_paper":"/paper/2508.15260","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:fa195cbceb64bd95b99dae34dbaeb085b2a2c3331f973fb19fe304b9f3201bb0","observation_id":"30a38d2c-3872-4046-8a2b-6ef600bed628","resolution":{"observed_at":"2026-08-14T11:18:55.744511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11988","last_updated":"2024-11-04T02:28:13Z","snapshot_observed_at":"2026-08-16T13:09:03.659202Z","submitted_at":"2024-10-15T18:51:18Z","title":"DISP-LLM: Dimension-Independent Structural Pruning for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11988","snapshot_observed_at":"2026-08-14T11:18:55.750080Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.750080Z"},"links":{"cited_paper":"/paper/2410.11988","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:0bbaeb9fa9b5772e1872979219da13bfb6a7b15270c1c1d8f286d047d17a0b44","observation_id":"e5c2b357-ebfe-4f01-ba69-4b9cc50ef1ca","resolution":{"observed_at":"2026-08-14T11:18:55.750080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:57.003862Z","title":null,"venue":null,"work_id":"efc684e0-ac89-4179-9266-69ea35448f51","year":2012},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.758856Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:26dbff34fffcff2b91508fb88b3e40d6cceb33a7d0f908345bb4b325ea96849b","observation_id":"3b7c3825-e50c-4a23-a3f3-be225b380f40","resolution":{"observed_at":"2026-08-14T11:18:57.009508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-14T11:18:55.767739Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.767739Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:5e1e3ccc3ead9202e2ac88ded51277cc56efabfc2d37fe897d7c6590ea7b4a0d","observation_id":"c4a53b9d-ec2c-4584-8eb5-86110a54592d","resolution":{"observed_at":"2026-08-14T11:18:55.767739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02626","last_updated":"2015-10-30T23:29:27Z","snapshot_observed_at":"2026-08-15T13:34:24.234242Z","submitted_at":"2015-06-08T19:28:43Z","title":"Learning both Weights and Connections for Efficient Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02626","snapshot_observed_at":"2026-08-14T11:18:55.773732Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.773732Z"},"links":{"cited_paper":"/paper/1506.02626","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:183180b73241626fe08f5514b7cf699e89dbcb0e582789abd86313c34aaf715a","observation_id":"e4d91a8f-b008-42f7-87e9-bff35d137bac","resolution":{"observed_at":"2026-08-14T11:18:55.773732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-14T11:18:55.779772Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.779772Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:c516ff67798a52a32fa46cd8498f469e267d7c3711753c36d2c37757082941ad","observation_id":"67754417-d4b1-4f3b-b16a-aff8afe1fe7b","resolution":{"observed_at":"2026-08-14T11:18:55.779772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-08-15T18:01:46.669862Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-14T11:18:55.789077Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.789077Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:602d43e9be76c73990e0e60d5e2406988bd94306c05732eb8c076f63b3b0de4d","observation_id":"ca503857-d6a9-42c4-b6f5-755c82b4c69d","resolution":{"observed_at":"2026-08-14T11:18:55.789077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-14T11:18:55.794693Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.794693Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:882f899fdc7405cc1f4f874fd5840baed4a129092785dbfa42c2382755f2efaf","observation_id":"905d1c20-1bfa-4dc6-b83a-e12a9e32cab0","resolution":{"observed_at":"2026-08-14T11:18:55.794693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08763","last_updated":"2024-11-03T10:25:47Z","snapshot_observed_at":"2026-08-16T14:01:20.113350Z","submitted_at":"2024-04-12T18:42:18Z","title":"CATS: Contextually-Aware Thresholding for Sparsity in Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08763","snapshot_observed_at":"2026-08-14T11:18:55.801091Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.801091Z"},"links":{"cited_paper":"/paper/2404.08763","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:5f45eaa24caac6434b17c0baef2bbc73ee57fb60886f2dc5dbd3ea06370720a2","observation_id":"60cb5110-fdd6-44d8-962a-42e5518abbae","resolution":{"observed_at":"2026-08-14T11:18:55.801091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-08-12T18:48:30.326248Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-14T11:18:55.807602Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.807602Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:6638b56fa5934e5ec374149281d524cc5df27c16d7ac00fe88a8a2b5f81fa6c5","observation_id":"aac788f3-fdf2-46d4-b665-440103a0f28d","resolution":{"observed_at":"2026-08-14T11:18:55.807602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-16T14:53:38.585468Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-14T11:18:55.813312Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.813312Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:24fa8ba40253732d1be3656b75bfe108524842bc7602bf1d78c5858fa9203093","observation_id":"cdc2d7da-3b4f-4d47-affd-1861f192a09c","resolution":{"observed_at":"2026-08-14T11:18:55.813312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.30956","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:56.921020Z","title":"Liu, Shang-Wen Li, and Hung-yi Lee","venue":null,"work_id":"911fc2f9-8abd-45e7-a066-dab5a2395ce8","year":2021},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.819687Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:4ed245280ac8ed75c42b6ddf08a752a2677656d78c8317e42acf930f7e137647","observation_id":"25803a84-c960-482d-a1d8-c60e4e50d335","resolution":{"observed_at":"2026-08-14T11:18:56.931536Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-14T11:18:55.827503Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.827503Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:de913762c35ad857f6b7daa070a057b8edb5f13ec14ddaa9a78c25b3a6a45c82","observation_id":"39b881e7-adc2-4705-b610-ae0a32dd6223","resolution":{"observed_at":"2026-08-14T11:18:55.827503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11627","last_updated":"2023-09-28T03:59:27Z","snapshot_observed_at":"2026-08-16T15:31:43.348408Z","submitted_at":"2023-05-19T12:10:53Z","title":"LLM-Pruner: On the Structural Pruning of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11627","snapshot_observed_at":"2026-08-14T11:18:55.834829Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.834829Z"},"links":{"cited_paper":"/paper/2305.11627","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:c3cbecb7a9477306500931fdfe4662d2920362b2ac599173de5768b692df1860","observation_id":"0deab149-c885-4565-96a2-cacdedf199f8","resolution":{"observed_at":"2026-08-14T11:18:55.834829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-08-17T01:46:43.513643Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-14T11:18:55.841891Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.841891Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:ebf196b7fc0b15759b21fe708b4ff8438f67c17f8d90af08ca1c64f718488086","observation_id":"14a97766-bf88-44bd-9552-7ec3d2458152","resolution":{"observed_at":"2026-08-14T11:18:55.841891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.847934Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.847934Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:466b13074efa2d49ff8d59ede318740358023fc185c0d50569cbfb199c77fc93","observation_id":"d7395e69-54a2-41d5-8f09-65d48f325583","resolution":{"observed_at":"2026-08-14T11:18:55.847934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12968","last_updated":"2024-08-12T04:48:11Z","snapshot_observed_at":"2026-08-16T14:08:17.591383Z","submitted_at":"2024-03-19T17:59:56Z","title":"LLMLingua-2: Data Distillation for Efficient and Faithful Task-Agnostic Prompt Compression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12968","snapshot_observed_at":"2026-08-14T11:18:55.853501Z","title":"Vicky Zhao, Lili Qiu, and Dongmei Zhang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.853501Z"},"links":{"cited_paper":"/paper/2403.12968","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:abd07e395b6e888585741ad8bbe8079fd660a0d05c11fafabf18f289d0300279","observation_id":"8326e22d-ff72-473a-973f-d2e571998a6e","resolution":{"observed_at":"2026-08-14T11:18:55.853501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.14132","last_updated":"2023-02-27T20:39:54Z","snapshot_observed_at":"2026-08-16T15:52:17.806831Z","submitted_at":"2023-02-27T20:39:54Z","title":"Structured Pruning of Self-Supervised Pre-trained Models for Speech Recognition and Understanding","version":1},"cited_work":{"arxiv_id":"2302.14132","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.14132","snapshot_observed_at":"2026-08-14T11:18:56.115425Z","title":"Structured Pruning of Self-Supervised Pre-trained Models for Speech Recognition and Understanding","venue":"cs.CL","work_id":"fd41aa0f-8279-4a2e-a3cb-89b75767c8c1","year":2023},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.860975Z"},"links":{"cited_paper":"/paper/2302.14132","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:232769c59d86c2f616846601e27848152ad18517f42b1d1a72f0c219eab34175","observation_id":"7f850403-55b2-4590-8398-358373890c72","resolution":{"observed_at":"2026-08-14T11:18:56.124255Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.878499Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.878499Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:25b546abbc5306f06deca3fbc99c755446443b8024c4c336a711758167a1cba5","observation_id":"678d861b-c664-449a-8a6c-f930fb7d995f","resolution":{"observed_at":"2026-08-14T11:18:55.878499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08608","last_updated":"2024-07-12T22:15:02Z","snapshot_observed_at":"2026-08-16T11:15:38.109255Z","submitted_at":"2024-07-11T15:44:48Z","title":"FlashAttention-3: Fast and Accurate Attention with Asynchrony and Low-precision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08608","snapshot_observed_at":"2026-08-14T11:18:55.883764Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.883764Z"},"links":{"cited_paper":"/paper/2407.08608","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:39dd8363dc4ead94d50512e5cb84c6b5ec684e7470532a80622a0b246dd539e8","observation_id":"d3a6cab5-9e7d-44ca-a618-ad7a452e6715","resolution":{"observed_at":"2026-08-14T11:18:55.883764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-08-13T04:32:33.562415Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-14T11:18:55.891804Z","title":"Zico Kolter","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.891804Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:b06a33d870d0732dcc65882f81c6444475ccfc68432683f90062fd9ad098599e","observation_id":"27962a3d-2fbd-40c9-beb4-d8bd6a6c14f5","resolution":{"observed_at":"2026-08-14T11:18:55.891804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.00937","last_updated":"2019-03-15T18:02:58Z","snapshot_observed_at":"2026-08-14T18:05:06.623407Z","submitted_at":"2018-11-02T15:34:29Z","title":"CommonsenseQA: A Question Answering Challenge Targeting Commonsense Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.00937","snapshot_observed_at":"2026-08-14T11:18:55.898271Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.898271Z"},"links":{"cited_paper":"/paper/1811.00937","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:385f8e063f00721affc7ef1d48162af1dec0845773a8e08a5aafed1e947d5f20","observation_id":"b6370f80-7d84-494b-b529-8382d32cd0ee","resolution":{"observed_at":"2026-08-14T11:18:55.898271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.904997Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.904997Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:d9b57ca959be6181691ac649c3c4ef2449bb335d5bb31629514c1637a5898113","observation_id":"478af4ee-65e8-4cee-a0ee-cd06441866b0","resolution":{"observed_at":"2026-08-14T11:18:55.904997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.912903Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.912903Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:17bcc2cd607f2a73588eacd00c5d96f34e9971f88bd2d3ba67af07328fae258a","observation_id":"83cbe73b-3c43-487c-9e22-b0e1d6d8432f","resolution":{"observed_at":"2026-08-14T11:18:55.912903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-14T11:18:55.919231Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.919231Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:340db793ce98e3ddbabbc887f2f63b329d6294825ebd8eba431c63f6df53b61f","observation_id":"aa6f9458-b90d-43af-8577-ade0ab135bba","resolution":{"observed_at":"2026-08-14T11:18:55.919231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-08-16T16:29:35.500686Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11089","snapshot_observed_at":"2026-08-14T11:18:55.925996Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.925996Z"},"links":{"cited_paper":"/paper/2502.11089","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:ab4c8ca8efcaf4e526beb0717324a6115406e8ce89c6a026f86c4e3d7fa2fb41","observation_id":"0cda5b9f-5308-4d98-aa45-2e637c3f237b","resolution":{"observed_at":"2026-08-14T11:18:55.925996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.932307Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.932307Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:da79ec4aa5f2036605066fbec1c1a3b9c21b24bf53f65e3e0f6783eb7181299e","observation_id":"3ac3a548-3386-4ba0-bf41-d6a6cac7a189","resolution":{"observed_at":"2026-08-14T11:18:55.932307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:18:55.938657Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.938657Z"},"links":{"citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:6dd67935009dbbb5eb973fed7c517a75a38b108b5bf75e6af1bcb5f70b29ec70","observation_id":"2703c17c-ee8f-4995-a60a-14865243ae03","resolution":{"observed_at":"2026-08-14T11:18:55.938657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T23:12:55.988146Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":64,"verified_exact":1,"verified_fuzzy":12},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 0 inbound Pith citation observations for arXiv:2608.13426."}