{"as_of":"2026-08-07T08:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2fd1415ae01b4fda5c3690ce9b9320eb3eb38e3f7b8ee150753aa3785dac5126","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:58:36.879455Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T07:56:00.180707Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T08:03:14.581676Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"cited_work":{"arxiv_id":"2506.23025","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23025","snapshot_observed_at":"2026-06-29T08:03:14.581676Z","title":"Spectra 1.1: Scaling laws and efficient inference for ternary language models.arXiv preprint arXiv:2506.23025, 2025","venue":null,"work_id":"c001c345-203e-4c0f-b7f7-89ca5c7a06b6","year":2025},"citing_paper":{"arxiv_id":"2605.29705","last_updated":"2026-05-28T10:04:02Z","snapshot_observed_at":"2026-08-07T00:41:33.225628Z","submitted_at":"2026-05-28T10:04:02Z","title":"BitTP: The Lightweight Trajectory Prediction Model with BitLLM for Edge-Devices","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T07:56:00.180707Z"},"links":{"cited_paper":"/paper/2506.23025","citing_paper":"/paper/2605.29705"},"observation_digest":"sha256:fd61c8437e961888f6b30499bc866eac9185eab0f747058fa4bfbe1459651ebc","observation_id":"4e30dd8c-6d9e-4981-965e-8f1f400d7a6d","resolution":{"observed_at":"2026-06-29T08:03:14.583306Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.23025/citation-record","integrity":"/paper/2506.23025/integrity","json":"/paper/2506.23025/citation-record.json","paper":"/paper/2506.23025"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:38.380926Z","title":null,"venue":null,"work_id":"bf07144e-c64f-4eea-95c9-5a1c933189a0","year":2022},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:31.734269Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:5d3132b78f7c452e4e53e2e9b81c86f38b8427e31d32accb3e9b1b8489ade50b","observation_id":"043f9fd2-3378-42ef-8928-1c0162ce458b","resolution":{"observed_at":"2026-08-06T21:58:38.488170Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:38.175393Z","title":null,"venue":null,"work_id":"526363df-1de9-4f49-a022-c9c00be09e13","year":2025},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:31.834775Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:a82c34f07af7f3744e1cc719ed1ce818071170b858c260732559126faf822fd5","observation_id":"31e32094-9184-4ef5-b85a-4af7c5319f8b","resolution":{"observed_at":"2026-08-06T21:58:38.265945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:31.911502Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:31.911502Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:12af0da8c997bd656ef53fe6dd5e56328bc9e889b496f405fbf728a042c80dc3","observation_id":"18dc2cab-fef3-4f54-859a-d81e85191989","resolution":{"observed_at":"2026-08-06T21:58:31.911502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-05T10:45:45.389337Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-06T21:58:31.996347Z","title":"Croci, Bo Li, Pashmina Cameron, Martin Jaggi, Dan Alistarh, Torsten Hoefler, and James Hensman","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:31.996347Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:82a44fcc89d97cf4d8160963d91c2950f232ffdb8a1752f1dc55330b2cb9724d","observation_id":"2853d9a1-345e-4dfa-aa63-05545243bb85","resolution":{"observed_at":"2026-08-06T21:58:31.996347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:32.074269Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.074269Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:ce1c2bdf142034a4d17823e3af1ed3ad094c6550fc3c0e8ce6884a42594a6bdb","observation_id":"01a92cbf-2490-48e8-80d5-b488dc582114","resolution":{"observed_at":"2026-08-06T21:58:32.074269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-06T21:58:32.172660Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.172660Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:f929dffa42fedf3cf404d4811b9253f3b1a29b1d4f2b49fad2a093296cdf7d61","observation_id":"d1ee3448-2f97-4f2d-9dc6-bfeaa50cc125","resolution":{"observed_at":"2026-08-06T21:58:32.172660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01373","last_updated":"2023-05-31T17:54:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-03T20:58:15Z","title":"Pythia: A Suite for Analyzing Large Language Models Across Training and Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01373","snapshot_observed_at":"2026-08-06T21:58:32.216688Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.216688Z"},"links":{"cited_paper":"/paper/2304.01373","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:72a8acd1f53aec3d60c51627782e8031003181de9d75e56b2fdc84a99c23b707","observation_id":"5940ab03-f85c-4634-9de9-cce79a301aff","resolution":{"observed_at":"2026-08-06T21:58:32.216688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:32.274923Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.274923Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:b92f06b0ea0a7a49c684d328cb4bb113d1f6ea6ce5edc409cb52bcb093eaa454","observation_id":"f8a1a219-c077-4728-8b4e-ddfe7109fddd","resolution":{"observed_at":"2026-08-06T21:58:32.274923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:32.321575Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.321575Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:ae45947152eddefc9c42f08d81d32e6dda645b620f7f6d476c04ff4d90dd438f","observation_id":"de534ba9-d725-4922-a149-af32acf7edfb","resolution":{"observed_at":"2026-08-06T21:58:32.321575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:37.926758Z","title":null,"venue":null,"work_id":"202a3688-d9f6-4da8-86a0-543bbf5decc9","year":2018},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.370832Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:4420d49e7a1681dfa2d93f3a6fdd451a73dbd136ffc6974997ffdfbd3fe9be18","observation_id":"c66afc96-aa07-459f-a274-0d1f24c6dbf8","resolution":{"observed_at":"2026-08-06T21:58:38.038396Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00075","last_updated":"2019-04-30T19:43:53Z","snapshot_observed_at":"2026-07-06T07:49:38.806531Z","submitted_at":"2019-04-30T19:43:53Z","title":"On the Use of ArXiv as a Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.00075","snapshot_observed_at":"2026-08-06T21:58:32.454216Z","title":"Clement, Matthew Bierbaum, Kevin P","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.454216Z"},"links":{"cited_paper":"/paper/1905.00075","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:ce4647951ac36e5e91129bbec5ea1a7880a36a83c0f44deecdb8350d763ec7d5","observation_id":"7557cc23-80e5-42a1-a5cd-49651c845cac","resolution":{"observed_at":"2026-08-06T21:58:32.454216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07339","last_updated":"2022-11-10T18:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-15T17:08:50Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07339","snapshot_observed_at":"2026-08-06T21:58:32.570981Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.570981Z"},"links":{"cited_paper":"/paper/2208.07339","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:0926f27f41c1f636dbc1df4f5ac353470369247707e0c38cec4865bd6b5ae462","observation_id":"9e22eb0b-b7f9-462d-808d-bc85989b7dae","resolution":{"observed_at":"2026-08-06T21:58:32.570981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09720","last_updated":"2023-02-28T00:12:34Z","snapshot_observed_at":"2026-08-05T14:58:58.675101Z","submitted_at":"2022-12-19T18:48:33Z","title":"The case for 4-bit precision: k-bit Inference Scaling Laws","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09720","snapshot_observed_at":"2026-08-06T21:58:32.672393Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.672393Z"},"links":{"cited_paper":"/paper/2212.09720","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:df57b07f68e6020fcb93f40696a6bab523d9eadbc5b78936f0bd5f77f7efc075","observation_id":"b24b96ee-9cb2-4c1f-a8be-9595a0b2aec9","resolution":{"observed_at":"2026-08-06T21:58:32.672393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T05:00:52.309220Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-06T21:58:32.738629Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.738629Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:6afdc18ffda2945ba10e85c2cf2c3a604699ae63ec757723525014de486c3624","observation_id":"1fd2de14-4d4f-44a4-accc-9c142150dc9a","resolution":{"observed_at":"2026-08-06T21:58:32.738629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-06T08:01:32.307047Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-08-06T21:58:32.827124Z","title":"Castro, Jiale Chen, Torsten Hoefler, and Dan Alistarh","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.827124Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:14269a37121cc058f59dc8b6e05f995d76b7bd57387e10af948d403e131e627a","observation_id":"fe734b39-930f-4176-a525-f89adae7241c","resolution":{"observed_at":"2026-08-06T21:58:32.827124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14123","last_updated":"2024-03-21T04:31:59Z","snapshot_observed_at":"2026-07-06T17:48:03.807374Z","submitted_at":"2024-03-21T04:31:59Z","title":"AI and Memory Wall","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14123","snapshot_observed_at":"2026-08-06T21:58:32.892001Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.892001Z"},"links":{"cited_paper":"/paper/2403.14123","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:26a159e18825ebec0d993a354c5c0b48ae4e13ae90ef3836d77d2dc54cf5e035","observation_id":"f6a3106f-23bd-4367-8473-6d828b051915","resolution":{"observed_at":"2026-08-06T21:58:32.892001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00838","last_updated":"2024-06-07T21:59:52Z","snapshot_observed_at":"2026-07-06T17:23:51.547578Z","submitted_at":"2024-02-01T18:28:55Z","title":"OLMo: Accelerating the Science of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00838","snapshot_observed_at":"2026-08-06T21:58:32.979052Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.979052Z"},"links":{"cited_paper":"/paper/2402.00838","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:4f487810924cc5a3b166dc9358158183b18e53489fdf5988b4b655cf07f652a5","observation_id":"395c0f88-5bd1-4427-9476-5ab598ea55f1","resolution":{"observed_at":"2026-08-06T21:58:32.979052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07304","last_updated":"2024-07-10T01:53:49Z","snapshot_observed_at":"2026-08-03T11:21:03.008977Z","submitted_at":"2024-07-10T01:53:49Z","title":"Inference Performance Optimization for Large Language Models on CPUs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07304","snapshot_observed_at":"2026-08-06T21:58:33.109191Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.109191Z"},"links":{"cited_paper":"/paper/2407.07304","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:aa289b0f4ec3c6e943f9e3329f2b17d14040d8ad78033867606e948f1e38485e","observation_id":"b36cff78-d508-44b1-b1b1-12d62d7a8d87","resolution":{"observed_at":"2026-08-06T21:58:33.109191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:33.252556Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.252556Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:b3360b1d6b1c75f1e776918bbaadcc20be2272b4150b44258457f5ac0e27751b","observation_id":"eac6f8c2-5709-47ae-8a0a-d9a27c70092a","resolution":{"observed_at":"2026-08-06T21:58:33.252556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-06T21:58:33.345161Z","title":"Rae, Oriol Vinyals, and Laurent Sifre","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.345161Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:77cf626edefd31fd4402ba5d45cd1c3d79c24673290ef5f0561a68300e020c86","observation_id":"c123ad72-3ab9-41d7-bb34-84dec3aa30c4","resolution":{"observed_at":"2026-08-06T21:58:33.345161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-06T21:58:33.466773Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.466773Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:038ef2c91cdcb9029848add58ae783d4238b1f2ef5fa12fcda7f2168c7da2ed1","observation_id":"36fa20ab-efa3-44ba-a884-97dd37e055d0","resolution":{"observed_at":"2026-08-06T21:58:33.466773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:33.616644Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.616644Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:a8a309b0d7ebc6669409a0d807fb8d1ac27f7ebb01c372372b1481984a1a06dc","observation_id":"ec326f9f-d017-4383-810f-92a610d37ac2","resolution":{"observed_at":"2026-08-06T21:58:33.616644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.12322","last_updated":"2019-06-13T17:55:30Z","snapshot_observed_at":"2026-08-04T04:17:53.148033Z","submitted_at":"2019-05-29T10:50:32Z","title":"A Study of BFLOAT16 for Deep Learning Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.12322","snapshot_observed_at":"2026-08-06T21:58:33.768061Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.768061Z"},"links":{"cited_paper":"/paper/1905.12322","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:4d16ebdc2fd4d24f5768c3c15fafea3895ced6f8713512aee4327a1a93569e25","observation_id":"07e6f9ba-7983-4f3e-b55f-e2ca0af43b6a","resolution":{"observed_at":"2026-08-06T21:58:33.768061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-06T21:58:33.897488Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.897488Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:640d4e86434db3bb5a774d9fbb7c4cf46c8931428321ce115ce0d8dec31fcaf6","observation_id":"e1620616-bb66-4051-bb89-a466468f14ea","resolution":{"observed_at":"2026-08-06T21:58:33.897488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12327","last_updated":"2024-10-11T04:44:55Z","snapshot_observed_at":"2026-07-06T18:47:37.971415Z","submitted_at":"2024-07-17T05:53:20Z","title":"Spectra: Surprising Effectiveness of Pretraining Ternary Language Models at Scale","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12327","snapshot_observed_at":"2026-08-06T21:58:33.986883Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.986883Z"},"links":{"cited_paper":"/paper/2407.12327","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:8df6f7247e53779a5949fc6b7a025e5eb5fe29509f620b07bca0b66aaa4b7526","observation_id":"eecffa83-f6e9-4163-aecf-1d9b0200a1dc","resolution":{"observed_at":"2026-08-06T21:58:33.986883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00978","last_updated":"2026-04-25T06:58:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T17:59:10Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00978","snapshot_observed_at":"2026-08-06T21:58:34.062944Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.062944Z"},"links":{"cited_paper":"/paper/2306.00978","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:db1a276ead4a696cb37f3f0bb21b0a9cfe99efddb789c1224c71e4bfe1a1b327","observation_id":"b0cd3050-1600-4ae6-8a3e-6399f56a75cc","resolution":{"observed_at":"2026-08-06T21:58:34.062944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:37.721852Z","title":null,"venue":null,"work_id":"1e7a547d-d017-4383-a1ad-925e48b24bb3","year":2021},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.130776Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:dc79f0df11fbc90b7cc5fabb28418ae38a52ec7c5ac253f54cd1c5014e36af32","observation_id":"3defb7d4-bbef-4f89-a002-db3a59ac1463","resolution":{"observed_at":"2026-08-06T21:58:37.798446Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:34.269003Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.269003Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:2416bb55978cb6c28459882444e4ecf907942b999b1d2122493665a0fd84237e","observation_id":"8baf29ef-435a-4f8c-958d-ec9d4197cd86","resolution":{"observed_at":"2026-08-06T21:58:34.269003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T21:58:34.462687Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.462687Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:3d4b12aa996e9a3153db44098ceff65fc9dfc328592019fbcacfe9c4ae8ec9ba","observation_id":"8d612af7-2ee9-41c5-9a18-59f9dcd2285f","resolution":{"observed_at":"2026-08-06T21:58:34.462687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:34.575134Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.575134Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:07b6e411486e77a4b60ce51ff87292ebef0696e3e6ee2a2bdecd427c59222e59","observation_id":"84027e9f-2f48-4fa1-8bca-bce4ced1dd74","resolution":{"observed_at":"2026-08-06T21:58:34.575134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-06T21:58:34.684907Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.684907Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:a46a34525dd3fb1e3a3fe2cdfd2bde7fa7f70c78935020fb1943e2687b402dc6","observation_id":"e6a8cc48-9708-4edd-af1d-e0d5f8486afb","resolution":{"observed_at":"2026-08-06T21:58:34.684907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.03740","last_updated":"2018-02-15T20:04:02Z","snapshot_observed_at":"2026-07-06T06:03:37.247241Z","submitted_at":"2017-10-10T17:42:04Z","title":"Mixed Precision Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.03740","snapshot_observed_at":"2026-08-06T21:58:34.765580Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.765580Z"},"links":{"cited_paper":"/paper/1710.03740","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:9bf1af57466f7afb5d81d5f6fcdc461e36b2747d0499a627583a0e18906d9ef7","observation_id":"c5593d79-5272-4f10-8bad-e857aca2d0dd","resolution":{"observed_at":"2026-08-06T21:58:34.765580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:34.826076Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.826076Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:a64d012c3dfb8fe84ae8069766f6ec40676557b7241dc16684a975a4ef947b57","observation_id":"3d50d194-b400-4bd7-8f73-c5a43bf8e1e2","resolution":{"observed_at":"2026-08-06T21:58:34.826076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:34.890095Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.890095Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:e51a965b5fdee235986dd3dbbdab40818659ddc22c61cabb06d6dd97aee32992","observation_id":"abb8dc68-6b02-4e90-8d66-810ee027b76f","resolution":{"observed_at":"2026-08-06T21:58:34.890095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.02054","last_updated":"2020-05-13T06:45:15Z","snapshot_observed_at":"2026-07-06T08:27:00.558613Z","submitted_at":"2019-10-04T17:29:39Z","title":"ZeRO: Memory Optimizations Toward Training Trillion Parameter Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.02054","snapshot_observed_at":"2026-08-06T21:58:34.952998Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.952998Z"},"links":{"cited_paper":"/paper/1910.02054","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:70abf686634005908a4920f4d69599b6f3c6aa15f57b13b4f74c4046b255b935","observation_id":"16aa179f-5384-407d-a866-16767bf710ef","resolution":{"observed_at":"2026-08-06T21:58:34.952998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:35.046766Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.046766Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:62bfee514e5f2de5033c9693fad471195ee1f775773b456ebdd9627e3a875090","observation_id":"01f9e2af-62a1-4733-94ec-1b461cfe0de2","resolution":{"observed_at":"2026-08-06T21:58:35.046766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00448","last_updated":"2025-04-14T10:11:13Z","snapshot_observed_at":"2026-07-06T17:10:21.098136Z","submitted_at":"2023-12-31T10:53:58Z","title":"Beyond Chinchilla-Optimal: Accounting for Inference in Language Model Scaling Laws","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00448","snapshot_observed_at":"2026-08-06T21:58:35.147343Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.147343Z"},"links":{"cited_paper":"/paper/2401.00448","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:f912b4ccd1a9b5ee36c356fdc4f0f280748f945d2cb251c3f7d76657237b55a8","observation_id":"b2aa463b-8e76-4e21-9235-7ae63ca4fb51","resolution":{"observed_at":"2026-08-06T21:58:35.147343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-06T21:58:35.267674Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.267674Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:c283c27b5799c14f2095b4449492c440c59f799903bda03caa88d3a14f15f9d2","observation_id":"b766b427-9e33-4b96-805e-77fcea5a6a0f","resolution":{"observed_at":"2026-08-06T21:58:35.267674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10818","last_updated":"2024-05-09T13:56:06Z","snapshot_observed_at":"2026-07-06T16:20:40.674175Z","submitted_at":"2023-09-19T17:59:54Z","title":"SlimPajama-DC: Understanding Data Combinations for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10818","snapshot_observed_at":"2026-08-06T21:58:35.356227Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.356227Z"},"links":{"cited_paper":"/paper/2309.10818","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:de2947c3a428add53eb5ff28b1fb2b5ef770e817bd7c1667d89b8000e95958b3","observation_id":"125a6f85-85df-4446-bcba-a359fa5ae593","resolution":{"observed_at":"2026-08-06T21:58:35.356227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06865","last_updated":"2023-06-12T07:48:53Z","snapshot_observed_at":"2026-08-06T08:43:40.051791Z","submitted_at":"2023-03-13T05:19:28Z","title":"FlexGen: High-Throughput Generative Inference of Large Language Models with a Single GPU","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.06865","snapshot_observed_at":"2026-08-06T21:58:35.399130Z","title":"Fu, Zhiqiang Xie, Beidi Chen, Clark Barrett, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.399130Z"},"links":{"cited_paper":"/paper/2303.06865","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:8b7f299d0af6d266cf70cd33c1fd26f1af4f408f375454c368e1338c9e4bde7a","observation_id":"87f419bc-5aec-4698-b04a-d2becef731fd","resolution":{"observed_at":"2026-08-06T21:58:35.399130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06585","last_updated":"2024-04-18T03:12:09Z","snapshot_observed_at":"2026-07-06T16:59:56.350207Z","submitted_at":"2023-12-11T18:17:43Z","title":"Beyond Human Data: Scaling Self-Training for Problem-Solving with Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06585","snapshot_observed_at":"2026-08-06T21:58:35.473834Z","title":"Co-Reyes, Rishabh Agarwal, Ankesh Anand, Piyush Patil, Xavier Garcia, Peter J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.473834Z"},"links":{"cited_paper":"/paper/2312.06585","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:e1d9dff2a548173d9fc70611628d30cfe4a704b675f1031ee8f43935bab5247d","observation_id":"500a8237-3561-48aa-9da6-c5369e86188f","resolution":{"observed_at":"2026-08-06T21:58:35.473834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:35.562469Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.562469Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:dd192004ed77270ccd8eb6a1d48ad074f21c571ef36ffa144c9cc5d0d51489ca","observation_id":"fe99ede9-18de-4469-9d59-d1c01a1af026","resolution":{"observed_at":"2026-08-06T21:58:35.562469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-06T21:58:35.673026Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.673026Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:5191c07a3e06369862ffb348a26858f9d4187081c213b59c4f3e12d3ea4fbce8","observation_id":"ae9c20c2-53a2-4f50-8791-d073e5264aa0","resolution":{"observed_at":"2026-08-06T21:58:35.673026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:37.496583Z","title":null,"venue":null,"work_id":"1be3560a-bf76-47a9-8f61-98e56da9c893","year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.747733Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:e4707d532956bebbfef0c5ce910f2663af3a21ec4f75a1d56c854a7aca02ef6b","observation_id":"3a897b84-1a1f-4030-aaa2-fa4b6a916c3d","resolution":{"observed_at":"2026-08-06T21:58:37.601154Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01981","last_updated":"2024-09-03T19:11:11Z","snapshot_observed_at":"2026-07-06T18:24:56.906947Z","submitted_at":"2024-06-04T05:47:17Z","title":"Zyda: A 1.3T Dataset for Open Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01981","snapshot_observed_at":"2026-08-06T21:58:35.866731Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.866731Z"},"links":{"cited_paper":"/paper/2406.01981","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:8badedc197e431473812510a75f3f95245990a4e22107af5e00cb0c2d4d82a9d","observation_id":"75429491-20db-4800-937b-80475b2c6c97","resolution":{"observed_at":"2026-08-06T21:58:35.866731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T21:58:35.969071Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.969071Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:c27150db2a9aa012ab1451f8b5bdfaf6282429154b7977044284985d93a43f95","observation_id":"b9dd0c37-8359-4947-a37e-51ad00c1f789","resolution":{"observed_at":"2026-08-06T21:58:35.969071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-06T21:58:36.058120Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.058120Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:3df6e2ca19ea5924c2ab95ea9083765b670d250ea6c4612cf2f49a7ded9e36af","observation_id":"da0819bb-ce4c-4d7e-b8ff-9f9e2a87b9c2","resolution":{"observed_at":"2026-08-06T21:58:36.058120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11453","last_updated":"2023-10-17T17:59:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-17T17:59:15Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11453","snapshot_observed_at":"2026-08-06T21:58:36.149982Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.149982Z"},"links":{"cited_paper":"/paper/2310.11453","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:bf14b9e53b894e758d5706c769cb77bd2c7f3e932297b2d615d31d450bbf1c58","observation_id":"f37302c6-31ab-4993-b7be-c8eaab8c52e0","resolution":{"observed_at":"2026-08-06T21:58:36.149982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-06T21:58:36.240388Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.240388Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:0506f516500d1eb365be672a59b28eab77af3a072191b3dc3460193848ffd097","observation_id":"5552d6d7-1b80-4ddd-aa62-0c0713c20f87","resolution":{"observed_at":"2026-08-06T21:58:36.240388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06209","last_updated":"2017-07-19T17:28:46Z","snapshot_observed_at":"2026-08-06T06:05:27.671303Z","submitted_at":"2017-07-19T17:28:46Z","title":"Crowdsourcing Multiple Choice Science Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06209","snapshot_observed_at":"2026-08-06T21:58:36.311075Z","title":"Liu, and Matt Gardner","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.311075Z"},"links":{"cited_paper":"/paper/1707.06209","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:89e576346ea1fed6741969b1e90d81eec2747da3817a50a665314e1c9648563e","observation_id":"8f5116bc-4633-40ec-96f3-c21e213e3288","resolution":{"observed_at":"2026-08-06T21:58:36.311075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10438","last_updated":"2024-03-29T19:21:58Z","snapshot_observed_at":"2026-08-05T00:47:41.615806Z","submitted_at":"2022-11-18T18:59:33Z","title":"SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10438","snapshot_observed_at":"2026-08-06T21:58:36.390497Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.390497Z"},"links":{"cited_paper":"/paper/2211.10438","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:d5001f33bf4a2beb273c6d09b6dfc1124a855a58f960cf44ce89c66c842f4685","observation_id":"917ace06-7174-4469-a713-81a5d3b91a29","resolution":{"observed_at":"2026-08-06T21:58:36.390497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:36.481514Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.481514Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:c0443834ff153987f0c89f1440658277cbe2c45aa112f0ddb458ccac592860a5","observation_id":"934eafdb-3037-40b1-9ce3-b952250a5c43","resolution":{"observed_at":"2026-08-06T21:58:36.481514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03493","snapshot_observed_at":"2026-08-06T21:58:36.595291Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.595291Z"},"links":{"cited_paper":"/paper/2210.03493","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:b8c7ca57292974f367cf1a0167304afe43230a02125fd60c10391dd409e499a0","observation_id":"825f6e34-122b-4d7a-9d80-0aa45d379904","resolution":{"observed_at":"2026-08-06T21:58:36.595291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14294","snapshot_observed_at":"2026-08-06T21:58:36.679879Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.679879Z"},"links":{"cited_paper":"/paper/2404.14294","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:112d86ae4d9b57fe227032f6762b93b32c697aeb73a57703ec9416c00ec531c7","observation_id":"7bee2538-7f33-4eb0-968a-d3bfff71fa10","resolution":{"observed_at":"2026-08-06T21:58:36.679879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:36.765576Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.765576Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:f129d940459e75957bd093c0a607def5f8c115fa8cf5f8d65370e5a09b2b0abd","observation_id":"f805acb6-f7d8-4221-bd8c-4ea49f5436ca","resolution":{"observed_at":"2026-08-06T21:58:36.765576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:36.879455Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.879455Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:28d1acb68f91ad36fcc4bd5742cc0b16485e1ab872bb86c48ff5a444da49a793","observation_id":"d239e124-dd9b-4f30-a247-cb214e06d237","resolution":{"observed_at":"2026-08-06T21:58:36.879455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T21:49:40.850962Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 1 inbound Pith citation observation for arXiv:2506.23025."}