{"as_of":"2026-08-11T14:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:744c4b895bf4d59bd71cb4075b6fda75c7b35ae5c245ee89537e0629025ad1db","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T05:04:00.410716Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.24953/citation-record","integrity":"/paper/2607.24953/integrity","json":"/paper/2607.24953/citation-record.json","paper":"/paper/2607.24953"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T05:04:00.298466Z","title":"Pretraining large language models with nvfp4.arXiv preprint arXiv:2509.25149, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.298466Z"},"links":{"citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:fe5b6d7b93a8557102216a0c8d3916a6b900f066955202df14580b730d90f0b0","observation_id":"6ab6a1df-e8a7-47ba-986f-31514fcfc6de","resolution":{"observed_at":"2026-07-31T05:04:00.298466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-01T16:27:35.664983Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-07-31T05:04:00.304222Z","title":"gpt-oss-120b & gpt-oss-20b model card.arXiv preprint arXiv:2508.10925, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.304222Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:9dde1eb18f48b42854ad86e913d2efeffbdba1c820cf0173e1cb8e319922b2b0","observation_id":"9f376e8f-4fb0-4a7c-a90c-7503df96073a","resolution":{"observed_at":"2026-07-31T05:04:00.304222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-08-11T05:54:56.124984Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-07-31T05:04:00.309234Z","title":"Estimating or propagating gradients through stochastic neurons for conditional computation.arXiv preprint arXiv:1308.3432, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.309234Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:b650cceb8abc5d7a3e5e7d7c9fbb87f2bec338f23c4b0249655bdb5529b64469","observation_id":"33469cad-66e4-43d7-8f56-86bb44bd2f71","resolution":{"observed_at":"2026-07-31T05:04:00.309234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T05:04:00.315111Z","title":"Quartet: Native fp4 training can be optimal for large language models.arXiv preprint arXiv:2505.14669, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.315111Z"},"links":{"citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:b365db119e2da909b441f6bbaaff09d53d6abe19b4b5d73dfe09fe056005b37d","observation_id":"81fd257d-a594-4009-8b80-cc7ab71a5d81","resolution":{"observed_at":"2026-07-31T05:04:00.315111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20853","last_updated":"2025-07-09T03:07:28Z","snapshot_observed_at":"2026-08-10T16:30:57.565671Z","submitted_at":"2025-02-28T08:51:55Z","title":"Oscillation-Reduced MXFP4 Training for Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20853","snapshot_observed_at":"2026-07-31T05:04:00.321201Z","title":"Oscillation-reduced mxfp4 training for vision transformers.arXiv preprint arXiv:2502.20853, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.321201Z"},"links":{"cited_paper":"/paper/2502.20853","citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:c630b1b752e3e2e9c86903335af894014d7d00176830e3fd15cd3ff193f1d40c","observation_id":"5a831031-1cc6-4c21-93be-60ef7c223387","resolution":{"observed_at":"2026-07-31T05:04:00.321201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19115","last_updated":"2025-08-10T07:10:29Z","snapshot_observed_at":"2026-08-09T06:55:04.491282Z","submitted_at":"2025-05-25T12:14:25Z","title":"FP4 All the Way: Fully Quantized Training of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19115","snapshot_observed_at":"2026-07-31T05:04:00.326163Z","title":"Fp4 all the way: Fully quantized training of llms.arXiv preprint arXiv:2505.19115, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.326163Z"},"links":{"cited_paper":"/paper/2505.19115","citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:ef2135eb0262007e06f8c19085c0de9531f7e53568c297907a22e0f83d789fdc","observation_id":"29efcb24-d89d-486f-9773-2cb109c39845","resolution":{"observed_at":"2026-07-31T05:04:00.326163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T05:04:00.332410Z","title":"A survey of low-bit large language models: Basics, systems, and algorithms.Neural Networks, page 107856, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.332410Z"},"links":{"citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:6e77bf510dd7b0a1652ec72a8e2fe825bc0feb343a9b5a88db9765a2f6eae20c","observation_id":"2fba09ef-95a1-4f8b-8743-f624c3f37506","resolution":{"observed_at":"2026-07-31T05:04:00.332410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.01043","last_updated":"2026-07-29T08:00:39Z","snapshot_observed_at":"2026-08-11T14:21:47.747766Z","submitted_at":"2025-05-02T06:33:25Z","title":"Low-Precision Training of Large Language Models: Methods, Challenges, and Opportunities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.01043","snapshot_observed_at":"2026-07-31T05:04:00.337750Z","title":"Low-precision training of large language models: Methods, challenges, and opportunities.arXiv preprint arXiv:2505.01043, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.337750Z"},"links":{"cited_paper":"/paper/2505.01043","citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:b452e78e7acb17319dd82dc8f15d73a6b9696272bdcf335197d2cbf4a831c288","observation_id":"8351f110-4e6f-40bb-b4c0-54b4054b48ed","resolution":{"observed_at":"2026-07-31T05:04:00.337750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T05:04:00.342685Z","title":"Towards fully fp8 gemm llm training at scale.arXiv preprint arXiv:2505.20524, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.342685Z"},"links":{"citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:c7b768379756e0666f801150a4d143d79bcf3965bf0793f4bce8721fbcb53cfa","observation_id":"2f400607-58e0-48c6-a5c8-2fca08502bf0","resolution":{"observed_at":"2026-07-31T05:04:00.342685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T05:04:00.347080Z","title":"How hungry is ai? benchmarking energy, water, and carbon footprint of llm inference, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.347080Z"},"links":{"citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:db3b0096c9f58ede11b1872442cc2c4f4361dca36556bc391d1e2ec27d91aa7f","observation_id":"af469695-b198-4798-9718-6e7d7f3a235e","resolution":{"observed_at":"2026-07-31T05:04:00.347080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T05:04:00.353010Z","title":"A comprehensive study on quantization tech- niquesforlargelanguagemodels","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.353010Z"},"links":{"citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:1d96bd3c11f3693158a4750a10832b6485deba3345fe5fc574bbcb254ba04c5c","observation_id":"7a98310b-afdc-4b22-82a7-6831a1a0e2aa","resolution":{"observed_at":"2026-07-31T05:04:00.353010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T05:04:00.358824Z","title":"Large language models: A survey, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.358824Z"},"links":{"citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:fa4bf0be011b223898d2f076ad587a5ac1560cce87b83e8cb854d41e1860ab09","observation_id":"4ef483db-a8fe-408a-be77-32f57ff7964e","resolution":{"observed_at":"2026-07-31T05:04:00.358824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08027","last_updated":"2025-08-18T19:51:06Z","snapshot_observed_at":"2026-08-09T09:33:39.206845Z","submitted_at":"2025-05-30T21:08:15Z","title":"Recipes for Pre-training LLMs with MXFP8","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08027","snapshot_observed_at":"2026-07-31T05:04:00.365982Z","title":"Recipes for pre-training llms with mxfp8.arXiv preprint arXiv:2506.08027, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.365982Z"},"links":{"cited_paper":"/paper/2506.08027","citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:24f7e2db24d1a9a6248c7a212d3ff6f5c9a7471f122341101c413a69bcb06cea","observation_id":"6bc22111-1ccd-450d-9be1-e93ba5b19779","resolution":{"observed_at":"2026-07-31T05:04:00.365982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.22813","last_updated":"2026-06-01T09:56:07Z","snapshot_observed_at":"2026-08-03T11:47:22.594738Z","submitted_at":"2026-01-30T10:39:11Z","title":"Quartet II: Accurate LLM Pre-Training in NVFP4 by Improved Unbiased Gradient Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.22813","snapshot_observed_at":"2026-07-31T05:04:00.370898Z","title":"Quartet ii: Accu- rate llm pre-training in nvfp4 by improved unbiased gradient estimation.arXiv preprint arXiv:2601.22813, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.370898Z"},"links":{"cited_paper":"/paper/2601.22813","citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:e59a2096772b883b6bd58f20d7acd56927ebe5ed90e91c4075ece4045648f998","observation_id":"c3884150-09d3-4a20-825f-8130a74c0878","resolution":{"observed_at":"2026-07-31T05:04:00.370898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10537","last_updated":"2023-10-19T16:38:33Z","snapshot_observed_at":"2026-08-08T01:04:32.134805Z","submitted_at":"2023-10-16T16:07:41Z","title":"Microscaling Data Formats for Deep Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10537","snapshot_observed_at":"2026-07-31T05:04:00.375801Z","title":"Microscaling data formats for deep learning.arXiv preprint arXiv:2310.10537, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.375801Z"},"links":{"cited_paper":"/paper/2310.10537","citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:b39cf6721aecc893fffc82e696a94e017c10bc3bc33983c182ea5a32934ce8cf","observation_id":"aca84154-2b5c-41cb-816f-ca068542a253","resolution":{"observed_at":"2026-07-31T05:04:00.375801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02423","last_updated":"2025-06-04T09:06:06Z","snapshot_observed_at":"2026-08-10T22:11:12.689065Z","submitted_at":"2025-01-05T02:30:41Z","title":"Scaling Laws for Floating Point Quantization Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02423","snapshot_observed_at":"2026-07-31T05:04:00.381195Z","title":"Scaling laws for floating point quantization training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.381195Z"},"links":{"cited_paper":"/paper/2501.02423","citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:72d04b9cbba5d108581b19f38bcf1d9f6397d9e3e40c71984c296f062b6e6b92","observation_id":"00f85fae-3c8b-49c9-a78b-317a714f8a6c","resolution":{"observed_at":"2026-07-31T05:04:00.381195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20586","last_updated":"2025-08-26T23:08:09Z","snapshot_observed_at":"2026-08-10T16:31:28.471977Z","submitted_at":"2025-02-27T23:01:31Z","title":"Training LLMs with MXFP4","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20586","snapshot_observed_at":"2026-07-31T05:04:00.386588Z","title":"Training llms with mxfp4.arXiv preprint arXiv:2502.20586, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.386588Z"},"links":{"cited_paper":"/paper/2502.20586","citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:42bf34ed9650e5d46b1b122ef2906d5be0f608e7a8c5af4993a66f897b57e635","observation_id":"bbb63f90-a6d0-40e8-899d-8bc3351116a2","resolution":{"observed_at":"2026-07-31T05:04:00.386588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17116","last_updated":"2025-05-23T09:44:25Z","snapshot_observed_at":"2026-08-02T15:17:06.428629Z","submitted_at":"2025-01-28T18:04:50Z","title":"Optimizing Large Language Model Training Using FP4 Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17116","snapshot_observed_at":"2026-07-31T05:04:00.391781Z","title":"Optimizing large language model training using fp4 quantization.arXiv preprint arXiv:2501.17116, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.391781Z"},"links":{"cited_paper":"/paper/2501.17116","citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:aae291c216e51d28ca31415baed96e1655eaabdd264d4b011c3a2fa248cb6833","observation_id":"12859446-fbe3-45d4-8726-9f08faf13fd4","resolution":{"observed_at":"2026-07-31T05:04:00.391781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19313","last_updated":"2025-02-12T23:37:50Z","snapshot_observed_at":"2026-08-08T09:40:07.284372Z","submitted_at":"2024-10-25T05:59:30Z","title":"COAT: Compressing Optimizer states and Activation for Memory-Efficient FP8 Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19313","snapshot_observed_at":"2026-07-31T05:04:00.397076Z","title":"Coat: Compressing optimizer states and activation for memory-efficient fp8 training.arXiv preprint arXiv:2410.19313, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.397076Z"},"links":{"cited_paper":"/paper/2410.19313","citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:c6d2a2f1036e64e269396a2205e9598ac72f052b495b0e8d905e67c0913bd15d","observation_id":"62aec842-e882-4a1a-8c21-e011467ea282","resolution":{"observed_at":"2026-07-31T05:04:00.397076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T05:04:00.403204Z","title":"An empirical study of microscaling formats for low-precision llm training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.403204Z"},"links":{"citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:0a8c1c4a05554eb7b9791d585c0ad0d5df56ec07c0596835e2e5653f253184f1","observation_id":"d536578f-bed7-4daa-9ac2-26b769a5bc4b","resolution":{"observed_at":"2026-07-31T05:04:00.403204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11458","last_updated":"2025-02-17T05:33:11Z","snapshot_observed_at":"2026-08-07T18:13:39.782795Z","submitted_at":"2025-02-17T05:33:11Z","title":"Towards Efficient Pre-training: Exploring FP4 Precision in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11458","snapshot_observed_at":"2026-07-31T05:04:00.410716Z","title":"Towards efficient pre-training: Exploring fp4 precision in large language models.arXiv preprint arXiv:2502.11458, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T05:04:00.410716Z"},"links":{"cited_paper":"/paper/2502.11458","citing_paper":"/paper/2607.24953"},"observation_digest":"sha256:24d67c8f7170ba04d72c08b20e320879c85054ab66119930d023617549a8bad6","observation_id":"1c56a2d8-8645-42e7-b3a4-ba66f9822115","resolution":{"observed_at":"2026-07-31T05:04:00.410716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.24953","last_updated":"2026-07-27T18:03:34Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T09:25:33.697504Z","submitted_at":"2026-07-27T18:03:34Z","title":"Stable FP4 Training via Transposition-Invariant Block Quantization"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2607.24953."}