{"as_of":"2026-08-08T11:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:acccde59ee9ac2a22f0543a5badf0f1750d42732c34cd07259442f5ea1a23191","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:14:01.423333Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:39:45.492485Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-08-07T15:14:01.423333Z","title":"CoRR, 2408.11743","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15909","last_updated":"2025-05-21T18:01:32Z","snapshot_observed_at":"2026-08-07T15:08:29.464697Z","submitted_at":"2025-05-21T18:01:32Z","title":"Is (Selective) Round-To-Nearest Quantization All You Need?","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T15:14:01.423333Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2505.15909"},"observation_digest":"sha256:fd0f7eee3bd6140c636ba829f240bbd0844e2acf88536c2f6b999019d8178870","observation_id":"3d38cf8b-ea40-411f-9334-1878b369d20b","resolution":{"observed_at":"2026-08-07T15:14:01.423333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-08-07T10:52:48.650576Z","title":"Marlin: Mixed-precision auto-regressive parallel inference on large language models.arXiv preprint arXiv:2408.11743, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04108","last_updated":"2025-06-05T05:39:48Z","snapshot_observed_at":"2026-08-08T01:16:59.339584Z","submitted_at":"2025-06-04T16:01:48Z","title":"Rectified Sparse Attention","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:52:48.650576Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2506.04108"},"observation_digest":"sha256:fdc41d4d3d507e2b2679d18e77122df5305cb8c3465c59a729356f88d30de32c","observation_id":"22abf7b4-91e0-48e1-b5b4-8b0ae3a4152c","resolution":{"observed_at":"2026-08-07T10:52:48.650576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-08-06T21:58:32.827124Z","title":"Castro, Jiale Chen, Torsten Hoefler, and Dan Alistarh","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-08T05:15:15.401238Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.827124Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:dfd567a169f574744beadb40a9cedb8ea602b233c094972f2111d85a00ac7894","observation_id":"fe734b39-930f-4176-a525-f89adae7241c","resolution":{"observed_at":"2026-08-06T21:58:32.827124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.11743","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-07-04T10:39:45.492485Z","title":"L., Chen, J., Hoefler, T., and Alistarh, D","venue":null,"work_id":"19ce2d31-0683-4f81-9db6-b9ca47099921","year":2024},"citing_paper":{"arxiv_id":"2602.13595","last_updated":"2026-05-01T17:25:12Z","snapshot_observed_at":"2026-08-06T09:33:04.037411Z","submitted_at":"2026-02-14T04:25:27Z","title":"The Quantization Trap: Breaking Linear Scaling Laws in Multi-Hop Reasoning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T22:27:49.943714Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2602.13595"},"observation_digest":"sha256:1bfc5c3d1b4a965088c6372002168a25622ded457dacc85e38ba33ca607f3fbb","observation_id":"dba3f5c5-a497-44c2-aed6-0a5112f34dd6","resolution":{"observed_at":"2026-05-15T22:30:22.035971Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.11743","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-07-04T10:39:45.492485Z","title":"L., Chen, J., Hoefler, T., and Alistarh, D","venue":null,"work_id":"19ce2d31-0683-4f81-9db6-b9ca47099921","year":2024},"citing_paper":{"arxiv_id":"2604.13806","last_updated":"2026-04-15T12:40:30Z","snapshot_observed_at":"2026-08-05T08:31:01.079299Z","submitted_at":"2026-04-15T12:40:30Z","title":"Robust Ultra Low-Bit Post-Training Quantization via Stable Diagonal Curvature Estimate","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T14:15:25.783283Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2604.13806"},"observation_digest":"sha256:df0cdd7326e1618e7a6a0f96ea16eb30a0f12352dab9a7a97a4d2d6082e4240c","observation_id":"cc2268d3-fe29-4278-bbfc-c56238e32119","resolution":{"observed_at":"2026-05-10T14:15:28.871774Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.11743","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-07-04T10:39:45.492485Z","title":"L., Chen, J., Hoefler, T., and Alistarh, D","venue":null,"work_id":"19ce2d31-0683-4f81-9db6-b9ca47099921","year":2024},"citing_paper":{"arxiv_id":"2604.20079","last_updated":"2026-04-22T00:53:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-22T00:53:43Z","title":"On the Quantization Robustness of Diffusion Language Models in Coding Benchmarks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T00:21:30.101748Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2604.20079"},"observation_digest":"sha256:5ecb55400313f61d69440a2a6b6256d7a03e08fef0682dd91d745b9ae19b41e0","observation_id":"748daa29-4c86-42e9-b226-daa366409178","resolution":{"observed_at":"2026-05-10T00:24:47.037549Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.11743","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-07-04T10:39:45.492485Z","title":"L., Chen, J., Hoefler, T., and Alistarh, D","venue":null,"work_id":"19ce2d31-0683-4f81-9db6-b9ca47099921","year":2024},"citing_paper":{"arxiv_id":"2604.21026","last_updated":"2026-04-24T07:54:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-22T19:18:30Z","title":"MCAP: Deployment-Time Layer Profiling for Memory-Constrained LLM Inference","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T00:54:33.897112Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2604.21026"},"observation_digest":"sha256:21ac0ebc2a5dc40dd324e8f576844da40e345fc3ce55d4f11a0d2e49709d5cd5","observation_id":"0383d94a-7265-4073-a26f-8b039f84430d","resolution":{"observed_at":"2026-05-10T00:54:48.389954Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.11743","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-07-04T10:39:45.492485Z","title":"L., Chen, J., Hoefler, T., and Alistarh, D","venue":null,"work_id":"19ce2d31-0683-4f81-9db6-b9ca47099921","year":2024},"citing_paper":{"arxiv_id":"2605.02404","last_updated":"2026-05-04T09:46:47Z","snapshot_observed_at":"2026-08-06T08:03:07.301851Z","submitted_at":"2026-05-04T09:46:47Z","title":"Statistically-Lossless Quantization of Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-09T16:22:13.399819Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2605.02404"},"observation_digest":"sha256:872a20510da9e80fd1c81057cb38dd1edc24c8d5b6d625964d16e52a580e8a85","observation_id":"0b29538f-c8c9-48b2-a311-c077cbef8d77","resolution":{"observed_at":"2026-05-11T16:31:10.085341Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.11743","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-07-04T10:39:45.492485Z","title":"L., Chen, J., Hoefler, T., and Alistarh, D","venue":null,"work_id":"19ce2d31-0683-4f81-9db6-b9ca47099921","year":2024},"citing_paper":{"arxiv_id":"2605.13915","last_updated":"2026-05-13T09:49:56Z","snapshot_observed_at":"2026-07-06T23:25:25.361350Z","submitted_at":"2026-05-13T09:49:56Z","title":"Multi-Scale Dequant: Eliminating Dequantization Bottleneck via Activation Decomposition for Efficient LLM Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T02:57:18.944617Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2605.13915"},"observation_digest":"sha256:e3ad434c55a7c993161fdb44bbd1baf495e41a0bf3d1bf93eb54a4d8ab506c33","observation_id":"00ce7d43-f1d6-40fc-80e7-5d319d9656f2","resolution":{"observed_at":"2026-05-15T02:58:34.202730Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.11743","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-07-04T10:39:45.492485Z","title":"L., Chen, J., Hoefler, T., and Alistarh, D","venue":null,"work_id":"19ce2d31-0683-4f81-9db6-b9ca47099921","year":2024},"citing_paper":{"arxiv_id":"2606.08094","last_updated":"2026-06-06T10:45:40Z","snapshot_observed_at":"2026-08-08T02:24:05.933156Z","submitted_at":"2026-06-06T10:45:40Z","title":"vla.cpp: A Unified Inference Runtime for Vision-Language-Action Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T19:41:57.350416Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2606.08094"},"observation_digest":"sha256:d750731b544aafb746174be367d1ae84201987d2748877e55bb527abffafade7","observation_id":"99b5642a-a6df-4c1d-8d29-951f569a962d","resolution":{"observed_at":"2026-07-02T21:37:24.737221Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.11743","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-07-04T10:39:45.492485Z","title":"L., Chen, J., Hoefler, T., and Alistarh, D","venue":null,"work_id":"19ce2d31-0683-4f81-9db6-b9ca47099921","year":2024},"citing_paper":{"arxiv_id":"2606.09682","last_updated":"2026-06-08T16:02:03Z","snapshot_observed_at":"2026-08-04T17:11:07.778917Z","submitted_at":"2026-06-08T16:02:03Z","title":"AutoMegaKernel: A Statically-Checked Agent Harness for Self-Retargeting Megakernel Synthesis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T16:59:11.821440Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2606.09682"},"observation_digest":"sha256:34939436c565f1194d0267bf6042e57c65446c37d25490002b1170ea5328c946","observation_id":"dff7ba71-ad0f-482c-8229-0f5facc5dc09","resolution":{"observed_at":"2026-07-03T00:57:29.436235Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.11743","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-07-04T10:39:45.492485Z","title":"L., Chen, J., Hoefler, T., and Alistarh, D","venue":null,"work_id":"19ce2d31-0683-4f81-9db6-b9ca47099921","year":2024},"citing_paper":{"arxiv_id":"2606.11357","last_updated":"2026-07-01T18:57:44Z","snapshot_observed_at":"2026-08-07T05:07:04.133282Z","submitted_at":"2026-06-09T18:33:14Z","title":"TileFuse: A Fused Mixed-Precision Kernel Library for Efficient Quantized LLM Inference on AMD NPUs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T11:26:56.230283Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2606.11357"},"observation_digest":"sha256:c08b33a4fa3de036627510ed9d42d597b537c16ee9a501fccf9c373d30cbd155","observation_id":"0387748f-437f-4a66-821c-29a58aafe98a","resolution":{"observed_at":"2026-07-03T07:57:44.946716Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.11743","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-07-04T10:39:45.492485Z","title":"L., Chen, J., Hoefler, T., and Alistarh, D","venue":null,"work_id":"19ce2d31-0683-4f81-9db6-b9ca47099921","year":2024},"citing_paper":{"arxiv_id":"2606.11357","last_updated":"2026-07-01T18:57:44Z","snapshot_observed_at":"2026-08-07T05:07:04.133282Z","submitted_at":"2026-06-09T18:33:14Z","title":"TileFuse: A Fused Mixed-Precision Kernel Library for Efficient Quantized LLM Inference on AMD NPUs","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-03T23:37:25.391853Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2606.11357"},"observation_digest":"sha256:1ba8bda5da10c53a8bb89056a7cf8638f886266d272be812ea66c8be834aba12","observation_id":"3a4a5887-8b73-41cd-8e0f-03d3901bdf78","resolution":{"observed_at":"2026-07-03T23:39:02.894834Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":"2408.11743","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-07-04T10:39:45.492485Z","title":"L., Chen, J., Hoefler, T., and Alistarh, D","venue":null,"work_id":"19ce2d31-0683-4f81-9db6-b9ca47099921","year":2024},"citing_paper":{"arxiv_id":"2606.23419","last_updated":"2026-06-22T14:42:34Z","snapshot_observed_at":"2026-07-06T23:58:11.694332Z","submitted_at":"2026-06-22T14:42:34Z","title":"GRINQH: Graded Input-based Quantization Hierarchy for Efficient LLM Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T08:38:32.577228Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2606.23419"},"observation_digest":"sha256:4b71faa7e1efbbb7b203eac4f7af77a45c4bd2c40b5390f49ebbcbd0f777015e","observation_id":"41709bc4-e638-4950-a218-3121d2e44dbc","resolution":{"observed_at":"2026-07-04T10:39:45.493866Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-08-01T00:15:48.293856Z","title":"Castro, Jiale Chen, Torsten Hoefler, and Dan Alistarh","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26316","last_updated":"2026-07-28T22:25:41Z","snapshot_observed_at":"2026-08-05T09:12:46.181266Z","submitted_at":"2026-07-28T22:25:41Z","title":"Route-Block Membership Selects Packed-AWQ Arithmetic: A Controlled Single-Fixture Mechanism Study","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T00:15:48.293856Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2607.26316"},"observation_digest":"sha256:beae64292b0f3ee4b4872a555926f41abe4195e5ab8134e5aac145e8545ed933","observation_id":"b43e328a-fb3f-472c-96ff-8c1c3a949f1f","resolution":{"observed_at":"2026-08-01T00:15:48.293856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2408.11743/citation-record","integrity":"/paper/2408.11743/integrity","json":"/paper/2408.11743/citation-record.json","paper":"/paper/2408.11743"},"outbound":[],"paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2408.11743."}