{"as_of":"2026-08-18T10:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:26850f46d7ae4e39cf23d8e06ce938ffc298696f0669d8ddc9253f38a400ae0f","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:07:15.153580Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:54:30.816676Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T10:54:31.239932Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.19821","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.19821","snapshot_observed_at":"2026-08-05T10:54:31.239932Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","venue":"cs.AR","work_id":"7550d691-3612-4b78-a183-14f645f9ab0b","year":2024},"citing_paper":{"arxiv_id":"2608.03867","last_updated":"2026-08-04T16:08:20Z","snapshot_observed_at":"2026-08-18T06:24:20.935343Z","submitted_at":"2026-08-04T16:08:20Z","title":"Heterogeneity-Aware Microscaling for Efficient Low-Bit LLM Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T10:54:30.816676Z"},"links":{"cited_paper":"/paper/2412.19821","citing_paper":"/paper/2608.03867"},"observation_digest":"sha256:53ee429894e1cc7ae219695844db8e484aedfe73aed89e2439d975fefd036ad4","observation_id":"fe303a0a-7967-48ef-bba0-6916b10b4dd8","resolution":{"observed_at":"2026-08-05T10:54:31.243463Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.19821/citation-record","integrity":"/paper/2412.19821/integrity","json":"/paper/2412.19821/citation-record.json","paper":"/paper/2412.19821"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.018824Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.018824Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:280b527034785f3808d7800cb695f1bab012e85502cb224f0f9dd0fe9f21c5b8","observation_id":"3b3c2a16-66dc-49c1-8993-d70acc83da4c","resolution":{"observed_at":"2026-08-11T15:07:15.018824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.993044Z","title":"A., Awan, A","venue":null,"work_id":"5712d87c-35ed-4bbe-a8b7-aed8efb4442e","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.024205Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:5dec4d1e05f94e82df9ddfaf0891004facc01581022168c366a32e3e6a750bcb","observation_id":"18110881-5841-4a97-9512-d0edc7b816b2","resolution":{"observed_at":"2026-08-11T15:07:15.996661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T15:07:15.028073Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.028073Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:a9c394c00269b3d0eb5fa636fdc69f45b49b813ae9c820170adaefa2556fcfe1","observation_id":"5e15c781-cb8e-4eb4-964f-e13e5fcc1945","resolution":{"observed_at":"2026-08-11T15:07:15.028073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.982041Z","title":"Pushing the Limits of Narrow Precision Inferencing at Cloud Scale with Microsoft Floating Point","venue":null,"work_id":"8e6b312a-b868-493f-ac28-f32efb882039","year":2020},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.034205Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:082ef4dc4bc1ab06660e40889ae2b06cd6e21f10ae5cf7544140529347ff1ed6","observation_id":"a3888b70-56c0-420a-b5fb-19dc4f01a8fe","resolution":{"observed_at":"2026-08-11T15:07:15.986125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.037771Z","title":"S., Naghshineh, S., Park, J., and Naumov, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.037771Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:e618580369e485b9a50a77cf9ec07d3dd581bd84a9c246041673764b73f2dee1","observation_id":"0d2701d2-b11e-4195-9589-79d87cd54c45","resolution":{"observed_at":"2026-08-11T15:07:15.037771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T15:07:15.041392Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.041392Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:ab23b5f04f3150599b0783dab89f2d5b3344785f6c237010ad576d70e36bd532","observation_id":"9ecb3caf-ef99-4dcf-a2d4-d0c303b6ae05","resolution":{"observed_at":"2026-08-11T15:07:15.041392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.971810Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","venue":null,"work_id":"0597e200-b28d-4edf-81e0-ca72ba335af0","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.045135Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:4868b877a08004524c4e5b4e8fe89f47dc2571719d314aac207bdbe78c5b3842","observation_id":"5d24d47c-722b-44da-9ed9-1064805b8ead","resolution":{"observed_at":"2026-08-11T15:07:15.975476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.049136Z","title":"A framework for few-shot language model evaluation, 07 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.049136Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:6e42f48ab7948c575279dfc804e2c4a1f3b6ba35ee9e16d538160a3f4dcb8993","observation_id":"4fb3f5b5-37d6-48a1-a59d-ee1331fa31a8","resolution":{"observed_at":"2026-08-11T15:07:15.049136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.053141Z","title":"W., and Keutzer, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.053141Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:360fa668994bd657ee891f615a097c55123d87eff6b2741a3991c49eb4573caa","observation_id":"d3492629-1d75-429e-9f39-f19db6dfaa81","resolution":{"observed_at":"2026-08-11T15:07:15.053141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.961258Z","title":"A., Welbl, J., Clark, A., et al","venue":null,"work_id":"980ed8f4-b484-47fb-b4f6-4c8c00c233aa","year":2022},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.056792Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:63ba648c2c1165ef24cf2e80f772b63a6509443fa87d1e990bd41d274d9c46ed","observation_id":"44f585db-1f74-42ae-84bd-3d472420d805","resolution":{"observed_at":"2026-08-11T15:07:15.965139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.948991Z","title":"W., Shao, Y","venue":null,"work_id":"a0156b47-759c-4940-a0ff-7611bb4d22b8","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.060408Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:f5e89190487af00d7515db9357ce431c6e60b52b65103c83ef92fa341115b34d","observation_id":"8685261d-13d6-4220-97f3-1b40b9510a31","resolution":{"observed_at":"2026-08-11T15:07:15.952934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.937929Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":"808f31cb-8c12-4406-94c1-b2e78bca20f1","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.064390Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:47361621d5744cb04379f7118bf3af5e8318b988d5ebdd20704903a171c7db77","observation_id":"e63849f1-c0bd-438e-9bfd-fc81cb5fd9dd","resolution":{"observed_at":"2026-08-11T15:07:15.941905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.927182Z","title":"B., Chess, B., Child, R., Gray, S., Radford, A., Wu, J., and Amodei, D","venue":null,"work_id":"32299761-ed45-4700-a907-bc4e04b73550","year":2020},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.068272Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:252fc7fcb8e46775ef85b66925000f8ffac65cb3f65efbde8522e9aee9a4c3af","observation_id":"cc0f5156-fd88-4a40-b77f-45834615bd29","resolution":{"observed_at":"2026-08-11T15:07:15.931082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.916657Z","title":"J., Wang, X., Nassar, M., Bansal, A","venue":null,"work_id":"34f5f110-a0ef-4f05-a501-cda90daeb16d","year":2017},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.071681Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:9743b1d4f4a45ee6e4fe443c6faa480adca766ee38f445b090197e9dd809f300","observation_id":"f10b2a27-b317-4a1b-b3c4-38f632a27e9b","resolution":{"observed_at":"2026-08-11T15:07:15.920175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.906613Z","title":"B., Zi, Y., Muennighoff, N., Kocetkov, D., Mou, C., Marone, M., Akiki, C., Li, J., Chim, J., Liu, Q., Zheltonozhskii, E., Zhuo, T","venue":null,"work_id":"8f25759e-69d5-4f46-91fa-c3057ab98c51","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.075307Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:ff13f1f018474b6c524ab23898fdc9cda8283d083852156d7fcc438bf79460d7","observation_id":"3f4e25aa-021c-4829-a9f1-0579f668bb34","resolution":{"observed_at":"2026-08-11T15:07:15.910113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.896078Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","venue":null,"work_id":"dd3677da-fb3f-477b-bd96-d7124c1c1238","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.078862Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:ce1a6fec30f37b1f9f50807821d8583e88b1a667ec59593c8d5622604e50f333","observation_id":"60336d6a-f5f2-49a4-831f-23b32f20eda8","resolution":{"observed_at":"2026-08-11T15:07:15.899502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.083427Z","title":"and Liu, R.-S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.083427Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:39d7a8da6db78b58ca86392bb77517a65bfa2b6bd65ac55669c045e80fef3a24","observation_id":"04312f69-af70-4e42-8071-c64d58fa026c","resolution":{"observed_at":"2026-08-11T15:07:15.083427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.884994Z","title":"Block and subword-scaling floating-point ( BSFP ) : An efficient non-uniform quantization for low precision inference","venue":null,"work_id":"8717957f-eab2-40c2-b593-86a7446790d3","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.087187Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:078b693b6470081d71aeff4441a5faa86d2c992aed9fabe7c40f5ed3bd1432f3","observation_id":"06f2469d-6d8d-455d-9035-6cf903d66ba0","resolution":{"observed_at":"2026-08-11T15:07:15.889084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.091124Z","title":"Lv: Latency-versatile floating-point engine for high-performance deep neural networks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.091124Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:25574bb4ff84c2336ded15d7964f8cd63535e7dbcd7dcd8f4f1877102f449e0f","observation_id":"fc762c23-1641-4367-a3a7-c482df4ed483","resolution":{"observed_at":"2026-08-11T15:07:15.091124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.095001Z","title":"P., Mallick, R., Wollaber, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.095001Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:451c3b6d388317b16a89c937c25bf19f9447133e9d6b90ed4112ef56dbca390c","observation_id":"f77f9c95-9e52-4f56-ae23-a0a84e321a76","resolution":{"observed_at":"2026-08-11T15:07:15.095001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.873497Z","title":"Intel Unleashes Enterprise AI with Gaudi 3, AI Open Systems Strategy and New Customer Wins","venue":null,"work_id":"0d117974-d58d-4e4e-8218-6ac767a2c03a","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.098780Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:4a227a3cc6e812a53fc2760c5dddb7168e5e2fb4665fadd38defe89769be4638","observation_id":"8f06c684-8754-4bcf-9dc1-d2ad0376fb90","resolution":{"observed_at":"2026-08-11T15:07:15.877503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.862104Z","title":"Pointer sentinel mixture models","venue":null,"work_id":"d773ae36-fe3a-4868-ada9-130a6912b607","year":2016},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.102652Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:6b721bc24ae51bfd910a902f28c26e7f28d436a464c23705376e6495be4c092c","observation_id":"04733370-e452-4e34-b4f8-c154b01b73a4","resolution":{"observed_at":"2026-08-11T15:07:15.866101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.848750Z","title":"Introducing Meta Llama 3: The most capable openly available LLM to date , 2024","venue":null,"work_id":"1b499b2b-55c7-408d-a6b8-a03626831c8d","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.106575Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:1a039da62738e632888c7efb8e5f3f5e7c317fc96a4372182aef706bfb28a76b","observation_id":"1bc2d6b2-ceb3-4125-b0a0-1a38903ba942","resolution":{"observed_at":"2026-08-11T15:07:15.853935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.836944Z","title":"NVIDIA Blackwell Architecture Technical Brief","venue":null,"work_id":"460472c3-7b0c-48f2-94a2-70bf08af7161","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.110216Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:d9de6b99a7230b0e3edf0b25b1c00489fc0abd8b8b2f5acd7836965ad66bcdcd","observation_id":"7762bdee-58fa-4694-9342-c45f48f5c7e6","resolution":{"observed_at":"2026-08-11T15:07:15.841018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-11T15:07:15.114160Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ramé, A., Ferret, J., Liu, P., Tafti, P., Friesen, A., Casbon, M., Ramos, S., Kumar, R., Lan, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.114160Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:2c2a6421f0af708c036533acb9606f75e2d351413d97a187ac4194a4d81c0209","observation_id":"ed3168e4-ce56-4101-9dbc-99ee8b783333","resolution":{"observed_at":"2026-08-11T15:07:15.114160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.824625Z","title":"D., Garegrat, N., Savell, T., More, A., Han, K.-N., Zhao, R., Mathew Hall, J","venue":null,"work_id":"0ab85bdf-828e-4f78-b881-2e692095cd13","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.118478Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:7bb73a58aa70c84071770dfd505c946bc44645ebb4d0a058ea1f64233eb3910d","observation_id":"267e194d-5e2d-44c1-983e-4718e1e8edb5","resolution":{"observed_at":"2026-08-11T15:07:15.829095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.813216Z","title":null,"venue":null,"work_id":"ddfb26b4-f050-4229-8c41-3cf24625d4bf","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.122331Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:47de5bf2eb821bc0b44e0411409723bbafee81a21eab8868f2e94e25e15a1ee9","observation_id":"b9296a21-9081-4672-a303-2d3d44187bd4","resolution":{"observed_at":"2026-08-11T15:07:15.817015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.126442Z","title":"Algorithm-Hardware Co-Design of Adaptive Floating-Point Encodings for Resilient Deep Learning Inference","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.126442Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:030073874a5a3a66bf046a6a43ee1eaca67fc5136f1826fb5572669bd19e1995","observation_id":"dbb0c251-fb08-465a-91bd-8e1a822fc2c4","resolution":{"observed_at":"2026-08-11T15:07:15.126442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.801603Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":null,"work_id":"6d08c28f-f06c-4966-be6c-3d10a05627c8","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.130334Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:5715825b1b28c78e9d418029bb8dd7e0d9648e8a5de6e9d003ace75471643a4b","observation_id":"9305df71-5818-458b-9765-1992dfc1b5f3","resolution":{"observed_at":"2026-08-11T15:07:15.805672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.134083Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.134083Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:2a9634a7b3234d72c782fdb438bc700810ac47d5526f4fb9870fcb924c58286c","observation_id":"8d275a21-5971-4ade-9133-e96d894178c3","resolution":{"observed_at":"2026-08-11T15:07:15.134083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.781768Z","title":"How to Quadruple LLM Decoding Performance with Speculative Decoding (SpD) and Microscaling (MX) Formats on Qualcomm Cloud AI 100","venue":null,"work_id":"4b777d99-810a-4e09-b59b-b5674fcca156","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.138117Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:8c31f40a071495d031e82d8ab364d3afcc81f63d39727730b3a661609a5d79c0","observation_id":"e4102f3b-1cb5-4f9c-9313-bd6091efc4e4","resolution":{"observed_at":"2026-08-11T15:07:15.785722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.769854Z","title":"GPTVQ: The Blessing of Dimensionality for LLM Quantization","venue":null,"work_id":"07f3221c-5b44-43f4-9c98-57a2307e33b7","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.142060Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:b28c7e67235136c6fdead5158cc072fae3a47616d7c28912230cc37d9145aed6","observation_id":"5d11f7c8-5ac0-468f-9de7-7d5a79aee403","resolution":{"observed_at":"2026-08-11T15:07:15.773784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3624582","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.180927Z","title":"Sg-float: Achieving memory access and computing power reduction using self-gating float in cnns","venue":null,"work_id":"a5c7bab1-c285-4fee-a00c-4934b94408f5","year":2023},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.145807Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:ccbfb126b17b3766a07dc5171265c312f517e727599c56763f2212a55b2eafdb","observation_id":"c6b1e348-98b5-4756-9f79-2a42c40efa11","resolution":{"observed_at":"2026-08-11T15:07:15.187085Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.759402Z","title":null,"venue":null,"work_id":"91c2f893-3092-4094-a3cc-3e0d548c86c1","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.149638Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:46ace5e97d06b6e36207e1dfe216038ca50fb80c96de520e0b151a8e9cdea928","observation_id":"199b1854-cbdc-4e42-af08-0edffc97e204","resolution":{"observed_at":"2026-08-11T15:07:15.762496Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:07:15.748773Z","title":"BiE: Bi-Exponent Block Floating-Point for Large Language Models Quantization","venue":null,"work_id":"53655b52-c9ee-4dec-a0e5-c68fab1b29c0","year":2024},"citing_paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T15:07:15.153580Z"},"links":{"citing_paper":"/paper/2412.19821"},"observation_digest":"sha256:3a10e531ebaa57d2777afd3694f18855a69665d8da0bd95718ba4d0dea0f0db5","observation_id":"372c4e47-7429-4808-b478-5740c607a5a3","resolution":{"observed_at":"2026-08-11T15:07:15.752504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.19821","last_updated":"2024-12-15T22:18:20Z","latest_version":1,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-18T00:25:54.134031Z","submitted_at":"2024-12-15T22:18:20Z","title":"Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":20},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2412.19821."}