{"as_of":"2026-08-03T14:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f9e7bbb6c1fd45f743ab50887b551a3da9dd25789f03cd476e47158f7cd95d38","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T18:49:40.758234Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:54:47.776037Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.06836","snapshot_observed_at":"2026-08-02T07:54:47.776037Z","title":"arXiv preprint arXiv:2604.06836 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09800","last_updated":"2026-07-28T02:32:08Z","snapshot_observed_at":"2026-08-02T07:54:44.716900Z","submitted_at":"2026-07-09T15:23:42Z","title":"Reference Traces for Auditing Invisible Weight Updates and Guiding Exact-Budget Protection","version":3},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-02T07:54:47.776037Z"},"links":{"cited_paper":"/paper/2604.06836","citing_paper":"/paper/2607.09800"},"observation_digest":"sha256:715fcdad2a3e0053bbe99a3fe5926f60d72796b810e63e72ad2e261d7543320d","observation_id":"35d96ce0-1d79-42b0-83e1-d93b44e760a7","resolution":{"observed_at":"2026-08-02T07:54:47.776037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.06836/citation-record","integrity":"/paper/2604.06836/integrity","json":"/paper/2604.06836/citation-record.json","paper":"/paper/2604.06836"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OCP Microscaling Data Formats (MX) Specification v1.0","venue":null,"work_id":"2d1e47a5-c84a-4cfb-a57e-fa30618152f3","year":2024},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:4506ad273071a270001ff44ca5b12f42a6dde8b49122f81a0b76dc9d982985b0","observation_id":"c313185b-0419-498d-ae35-cc38877b2d2d","resolution":{"observed_at":"2026-05-16T14:33:01.323907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:b867142cc68672037a60815319f6bf88e60393392bb193286b69a225f520639f","observation_id":"5d81f5aa-4b3c-4e2e-81f8-9e32be102c3a","resolution":{"observed_at":"2026-05-10T23:55:49.346247Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e6416808-6f0d-4ed3-b207-73ae63e7c20d","year":2023},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:ef2d06946f0200f57067eb2502a51668775fd014579754262c4ecfcecf787c9f","observation_id":"173458db-6466-4e7d-a73d-6cb7fa115d87","resolution":{"observed_at":"2026-05-16T14:33:01.313606Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"1999.Elements of information theory","venue":null,"work_id":"4fc946d2-24d5-49a2-bc46-83019c15f424","year":1999},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:d168292e7e9ce09c3c2ec9c519882a5e910a6ba8c8d93429ef99a1f2df2dfbb3","observation_id":"1900575c-ce91-4ef9-87b2-81f5cb76aba6","resolution":{"observed_at":"2026-05-16T14:33:01.318142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02861","last_updated":"2022-06-20T16:05:15Z","snapshot_observed_at":"2026-07-06T11:55:04.054344Z","submitted_at":"2021-10-06T15:43:20Z","title":"8-bit Optimizers via Block-wise Quantization","version":2},"cited_work":{"arxiv_id":"2110.02861","doi":"10.48550/arxiv.2110.02861","metadata_source":"arxiv_reference","pith_arxiv_id":"2110.02861","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Dettmers, M","venue":null,"work_id":"dc9d8ece-f716-493d-89a8-2a30dedcceb4","year":2021},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2110.02861","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:5f199ece75092fa7891c63d8743f8b151b762460962a1e87328a38dbf1103cf1","observation_id":"b35a8172-04e3-4064-94fa-f70c1bbedace","resolution":{"observed_at":"2026-05-10T23:55:49.370629Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"86d5dd25-16be-4322-a205-3df6b497590f","year":2023},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:9414a92ef336e029656fa31bee43771d2049ab256a81190de3e7b4337eaae6a3","observation_id":"1e857bed-2108-4f7a-bd00-9602a82ca82b","resolution":{"observed_at":"2026-05-16T14:33:01.321381Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fd3ec2e0-64c1-4d31-9043-e66fddd0782f","year":2020},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:d493454219a9ab4c66cfe0e5e4bf481bb92d63927dc4dc6da2e2a4cac260d685","observation_id":"d6720081-1555-45b5-b8da-6970a590e90d","resolution":{"observed_at":"2026-05-16T14:33:01.331356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d3d74370-bac5-4a81-ae2c-861cb9d5bbef","year":null},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:2be0835c62b8d4be54d530feb34bd1a0d41550573f654c508921a3617d446e75","observation_id":"7c48cfdb-9015-4a02-aaad-9594a6c74cf3","resolution":{"observed_at":"2026-05-16T14:33:01.326142Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InProceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"c97ad475-e197-4e79-ae34-6f5f6551b030","year":null},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:10bb5a6382a68b6639fb76e8b6a614e61e52fae7f14144cfbc980838914853c6","observation_id":"fa243139-9f91-47eb-a2b8-c5d6fa7c85ac","resolution":{"observed_at":"2026-05-16T14:33:01.328744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bbeae3ce-387a-45fd-9a37-563c373c96d0","year":2017},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:49090882bc1421c59644b597a569fe85b1fccac617dc4dc99e8075936f098cd4","observation_id":"44d3966d-938c-43b3-8dad-b235fc4563d9","resolution":{"observed_at":"2026-05-16T14:33:01.315778Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"af13b58c-c77a-4a47-bebc-1a9ecc3c8b0f","year":2024},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:a36999c5cd87c3fa2c2e187011a80b4ded165da8688936528ae70f09fb6b2fb6","observation_id":"ba8fa601-3022-40d1-952d-145c890becd8","resolution":{"observed_at":"2026-05-16T14:33:01.358797Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14342","last_updated":"2024-03-05T17:07:16Z","snapshot_observed_at":"2026-07-06T15:31:51.249701Z","submitted_at":"2023-05-23T17:59:21Z","title":"Sophia: A Scalable Stochastic Second-order Optimizer for Language Model Pre-training","version":4},"cited_work":{"arxiv_id":"2305.14342","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.14342","snapshot_observed_at":"2026-07-09T17:36:25.374536Z","title":"Sophia: A scalable stochastic second-order optimizer for language model pre-training, 2024a","venue":"cs.LG","work_id":"91ee7625-8541-4461-90b4-5f7e2e9ddad1","year":2023},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2305.14342","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:e0c30083cf02743ec1221ef7a37a1e59ace5357200a819f091d1d225d197083b","observation_id":"1e31ab96-ce91-475e-8898-20a5a0dda58d","resolution":{"observed_at":"2026-05-10T23:50:57.041214Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09353","last_updated":"2024-07-09T05:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-14T17:59:34Z","title":"DoRA: Weight-Decomposed Low-Rank Adaptation","version":6},"cited_work":{"arxiv_id":"2402.09353","doi":"10.48550/arxiv.2402.09353","metadata_source":"pith","pith_arxiv_id":"2402.09353","snapshot_observed_at":"2026-07-10T11:37:03.195647Z","title":"DoRA: Weight-Decomposed Low-Rank Adaptation","venue":"cs.CL","work_id":"6726c65c-0da8-4d37-9dae-84dbdd936ae4","year":2024},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2402.09353","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:ad56c82ed46770e9d147a27941f794227ad2061933cb3fd5c01e463ee3374cd6","observation_id":"61c01a40-d29a-4e39-a9ba-f72cc79ca65e","resolution":{"observed_at":"2026-05-15T22:26:21.985634Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:b4201275d4f920d49eca7027a808098e1548f01717d9e2f46c5ce6d4b2bd692a","observation_id":"26993bbf-bad5-40f4-a455-90255b8148a2","resolution":{"observed_at":"2026-05-10T23:55:49.394539Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a3b3c56d-ac1b-46cb-8b5c-d1daac352a08","year":2024},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:40abefc17fa0ef94161f5b3a654964d0ea3f1d204cfcc446cb396191f912005b","observation_id":"29c2f059-f440-40a5-b1a4-5624540182f1","resolution":{"observed_at":"2026-05-16T14:43:01.227693Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:20989c0be02396d66cc62da380f0d660e5252b12be0914afca4047a67356a91e","observation_id":"1d293173-3f92-480b-bddd-e6d3bcc2850b","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f39afb01-1001-41d2-a1d6-5d277bdd8304","year":2023},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:477d0702a46e65f39df725845e9af733b564912c68815eb28d3ccc2609dedec2","observation_id":"f49e8b6a-f5a7-4fd1-bd91-18ebadd9237a","resolution":{"observed_at":"2026-05-16T14:43:01.225804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.05433","last_updated":"2022-09-29T20:47:07Z","snapshot_observed_at":"2026-07-06T13:51:20.183063Z","submitted_at":"2022-09-12T17:39:55Z","title":"FP8 Formats for Deep Learning","version":2},"cited_work":{"arxiv_id":"2209.05433","doi":"10.48550/arxiv.2209.05433","metadata_source":"pith","pith_arxiv_id":"2209.05433","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"FP8 Formats for Deep Learning","venue":"cs.LG","work_id":"c7217bc9-e53d-40c5-a437-25a74abc36cd","year":2022},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2209.05433","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:5639e56fb28dbd6f13b55152d4e3f9bfff1b4e2ca4f068287e8a8c4f0c15a545","observation_id":"3572185c-7927-4f2f-8418-151fc6a1d0a6","resolution":{"observed_at":"2026-05-15T09:47:03.886089Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:35.618396+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:35.618396+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022–2024","venue":null,"work_id":"aecc9e24-cc6d-44d8-ad74-cdcad11e6970","year":2022},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:4b18da1cf8cdab9f652b0797c035b4688997779518e1e04174e391fe678d0b2e","observation_id":"f488cd5d-bdde-4031-858b-8f2ba01d7cf2","resolution":{"observed_at":"2026-05-16T14:43:01.223684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10517","last_updated":"2024-06-21T05:20:56Z","snapshot_observed_at":"2026-07-06T17:31:04.675896Z","submitted_at":"2024-02-16T09:06:06Z","title":"Any-Precision LLM: Low-Cost Deployment of Multiple, Different-Sized LLMs","version":4},"cited_work":{"arxiv_id":"2402.10517","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.10517","snapshot_observed_at":"2026-07-04T10:39:45.459649Z","title":"Any-precision llm: Low-cost deployment of multiple, different-sized llms","venue":null,"work_id":"bbae9429-2d4c-4dab-91e8-3125fe61736c","year":2024},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2402.10517","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:cc8c831e38c9c7c2c254b3d610c0f27f56f4633e16ae970dc8c8b7e9c647bfec","observation_id":"ba2c79a2-c796-41fe-afa2-fa62c34b4a6d","resolution":{"observed_at":"2026-05-10T23:50:57.115470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"824a0f29-d241-4b51-8beb-4a5b7b4e776a","year":2020},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:fc12548623411a9a1e86e9c4f364215d1cf40c805e7ca88bbbe77390b7de5b94","observation_id":"67749d3b-6fa8-4d43-8816-c7b4b9de020c","resolution":{"observed_at":"2026-05-16T14:33:01.344325Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cf7a3457-9fd8-4c55-931d-f8cdb129f036","year":2021},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:60aa89fd03ee0776f3ae9104ccdcdb00d5fc833051c7f9be2aead93e5f2ff7c2","observation_id":"22d8d1f1-d258-4dd5-ae91-cfc4d2cca169","resolution":{"observed_at":"2026-05-16T14:33:01.347223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":"2308.12950","doi":"10.48550/arxiv.2308.12950","metadata_source":"pith","pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-07-11T03:17:52.238641Z","title":"Code Llama: Open Foundation Models for Code","venue":"cs.CL","work_id":"e73bffa4-7620-47ac-9327-259a60db52ca","year":2023},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:82571ed42f70f2a3640a51781ecf8a36b0ad5f428dfdfa78214dd2ac3fc931ae","observation_id":"1c1666d1-a365-499e-9fe6-6fc438825396","resolution":{"observed_at":"2026-05-10T23:50:57.052999Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:36.742994+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:36.742994+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"04661c69-897c-4d80-b9bc-c868a867e43a","year":1959},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:b9000ad0eced619811d6b32a4bed1d4f269aa7cae43aee7d6b48bdb66843329e","observation_id":"a4fa52f5-4a64-4eee-90fd-b023ad987cb9","resolution":{"observed_at":"2026-05-16T14:33:01.350095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"39f2d36f-292b-4537-8d5a-ca7c6a315b96","year":2023},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:2e46d6d7239048ede01281a61ed3f3ac3b31bffbeb62f27373aa105993846e7b","observation_id":"e0fb67f7-4eca-4421-beb4-7905dc0dad3b","resolution":{"observed_at":"2026-05-16T14:33:01.353117Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11453","last_updated":"2023-10-17T17:59:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-17T17:59:15Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","version":1},"cited_work":{"arxiv_id":"2310.11453","doi":"10.48550/arxiv.2310.11453","metadata_source":"pith","pith_arxiv_id":"2310.11453","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","venue":"cs.CL","work_id":"28ad8f61-4291-4894-b120-1d42fc9937a3","year":2023},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2310.11453","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:32ec535a5222869bf718d51409faf23f9ed0c6d05b2fd6a386907b541f84f4d5","observation_id":"78db408b-f14e-4e85-8158-3dd1ee08552e","resolution":{"observed_at":"2026-05-10T23:50:57.060744Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"70754d94-fc45-4909-b2a3-c5d173a84ccb","year":2019},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:b946bf229d0a886a6decca4a9813b0b728ba628975784c149306bec975db89d1","observation_id":"a7e7f8c6-a30f-4213-9965-b0a497d2fa30","resolution":{"observed_at":"2026-05-16T14:33:01.355855Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c20e23ec-9c01-4ac2-8b76-2d24efe63c40","year":null},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:12e941a159aef14e0d8b5b5b700c354543b20f365e5a02e93b56487e410ef09b","observation_id":"274c7201-6ab6-434f-97ab-5ca543a95a17","resolution":{"observed_at":"2026-05-16T14:33:01.339240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12422","last_updated":"2024-07-21T02:23:00Z","snapshot_observed_at":"2026-07-06T17:46:46.415492Z","submitted_at":"2024-03-19T04:09:11Z","title":"Jetfire: Efficient and Accurate Transformer Pretraining with INT8 Data Flow and Per-Block Quantization","version":2},"cited_work":{"arxiv_id":"2403.12422","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.12422","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"652b5d43-09b6-4922-88a2-25c3d83a18ab","year":2024},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2403.12422","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:bbbd58cfb59b0678a334d4c97bb2b85cb434a1a8cf900eb6939f98493dbae657","observation_id":"1410c832-e6e5-4689-a901-ef5d4e27045d","resolution":{"observed_at":"2026-05-10T23:50:57.109952Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"86fb131e-b019-48db-b5fb-778db5bd8901","year":2024},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:6d653c4271eee6c7164ed595acd548e9d5dd686918135c344892e3ad346d3107","observation_id":"a6a56ddf-cdc2-45e8-995f-07274a4734be","resolution":{"observed_at":"2026-05-16T14:33:01.341420Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.10462","last_updated":"2021-02-20T22:37:41Z","snapshot_observed_at":"2026-07-06T10:43:11.902082Z","submitted_at":"2021-02-20T22:37:41Z","title":"BSQ: Exploring Bit-Level Sparsity for Mixed-Precision Neural Network Quantization","version":1},"cited_work":{"arxiv_id":"2102.10462","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2102.10462","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"20e3b8d7-7e95-40b9-aad0-7abc1d0e108b","year":2021},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2102.10462","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:ef06e9881b6386a8b12c0934105dd11b1f034ac4fe08c879f5309b865434e7b3","observation_id":"29317db9-25e8-482b-b93c-4315196e1aa6","resolution":{"observed_at":"2026-05-10T23:50:57.088595Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6160e230-cad3-4318-8b66-48be9eb06315","year":2021},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:f6af5110177659fead14e15c444cc44d6e184a8f20f07ebdbcd1428c7e3c5c69","observation_id":"d2e3be07-b002-47bc-93d3-667347d1e158","resolution":{"observed_at":"2026-05-16T14:33:01.334042Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d14e1458-e0ff-47f9-97b8-84f0eaff3953","year":2022},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:aaa91ee29acd80ec17e6d9f6824517417c9e807c6fdff286844ebe13500998c0","observation_id":"fa3f298a-1c83-4324-87d8-926b0c8df63f","resolution":{"observed_at":"2026-05-16T14:33:01.336729Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16793","last_updated":"2025-02-24T11:29:08Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T16:56:41Z","title":"Adam-mini: Use Fewer Learning Rates To Gain More","version":7},"cited_work":{"arxiv_id":"2406.16793","doi":"10.48550/arxiv.2406.16793","metadata_source":"pith","pith_arxiv_id":"2406.16793","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Adam-mini: Use fewer learning rates to gain more.arXiv preprint arXiv:2406.16793","venue":"cs.LG","work_id":"988d7ebd-209d-4382-80e6-0d367b74e767","year":2024},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2406.16793","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:9e1652b12bcb0cb2908d147381ccc64628fa1443fead8df7f1499388296e3f38","observation_id":"aeceb0e6-5386-4b6e-800e-8555f3982c52","resolution":{"observed_at":"2026-05-10T23:55:49.411139Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08296","last_updated":"2024-07-11T08:42:58Z","snapshot_observed_at":"2026-07-06T18:44:41.370135Z","submitted_at":"2024-07-11T08:42:58Z","title":"Q-GaLore: Quantized GaLore with INT4 Projection and Layer-Adaptive Low-Rank Gradients","version":1},"cited_work":{"arxiv_id":"2407.08296","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08296","snapshot_observed_at":"2026-06-30T09:54:35.093121Z","title":"Q-galore: Quantized galore with int4 projection and layer-adaptive low-rank gradients","venue":null,"work_id":"5a01a74b-c7f4-4130-9276-d82654cc38b9","year":2024},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2407.08296","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:1af1c87a21d1a1cfb6cb1c45f77fb0404e3a264211ebdfb8205894916fe5c58a","observation_id":"10ebd6c7-9b4d-4d50-8f16-5339a27965f5","resolution":{"observed_at":"2026-05-10T23:50:57.104621Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03507","last_updated":"2024-06-02T21:24:12Z","snapshot_observed_at":"2026-07-06T17:40:15.746482Z","submitted_at":"2024-03-06T07:29:57Z","title":"GaLore: Memory-Efficient LLM Training by Gradient Low-Rank Projection","version":2},"cited_work":{"arxiv_id":"2403.03507","doi":"10.48550/arxiv.2403.03507","metadata_source":"pith","pith_arxiv_id":"2403.03507","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"GaLore: Memory-Efficient LLM Training by Gradient Low-Rank Projection","venue":"cs.LG","work_id":"c34c4978-e4f0-49cb-98d8-47f58142e848","year":2024},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2403.03507","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:7f6ecb167d45f9b9fe394fb0fe82331e00bac91dd990fe37185dbf7567420654","observation_id":"f1fc8388-31e1-4e25-a63e-e9953f03ebea","resolution":{"observed_at":"2026-05-16T23:51:50.393199Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":"2303.18223","doi":"10.18653/v1/d16-1080","metadata_source":"pith","pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"A Survey of Large Language Models","venue":"cs.CL","work_id":"de1b42b5-4a0a-4b1f-8c78-1f7fe21be6c9","year":2023},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:81609faa4201495d622e00e9d424a9a2344a47b03de5b34fc76e992a051e8d67","observation_id":"854c4a3a-a5c3-4a44-bf91-fd23fbf6e76d","resolution":{"observed_at":"2026-05-10T23:50:57.081052Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":17,"verified_exact":15,"verified_fuzzy":4},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 3 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 1 inbound Pith citation observation for arXiv:2604.06836."}