{"as_of":"2026-08-22T21:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5d7682f7f96f8b59ced58bb136376d39da26b146999bc37bebe1d5707b41b9b9","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T08:50:47.018279Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T14:53:22.233844Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T14:53:31.629781Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"cited_work":{"arxiv_id":"2510.18784","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.18784","snapshot_observed_at":"2026-06-19T17:11:53.086525Z","title":"Cage: Curvature-aware gradient estimation for accurate quantization-aware training","venue":null,"work_id":"6d5f50b2-b39e-4c96-8a83-e95c3a2e8f96","year":2025},"citing_paper":{"arxiv_id":"2604.03420","last_updated":"2026-05-08T06:46:47Z","snapshot_observed_at":"2026-07-31T05:51:44.917483Z","submitted_at":"2026-04-03T19:33:25Z","title":"Zero-Shot Quantization via Weight-Space Arithmetic","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T20:07:41.196837Z"},"links":{"cited_paper":"/paper/2510.18784","citing_paper":"/paper/2604.03420"},"observation_digest":"sha256:c469eab704ce5e2c6406d329e585c3f7603e785728fcc16cae85b74d8829787e","observation_id":"679171c1-06d7-4e7a-8441-fe99e6fc2353","resolution":{"observed_at":"2026-06-19T17:11:53.086525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"cited_work":{"arxiv_id":"2510.18784","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.18784","snapshot_observed_at":"2026-06-19T17:11:53.086525Z","title":"Cage: Curvature-aware gradient estimation for accurate quantization-aware training","venue":null,"work_id":"6d5f50b2-b39e-4c96-8a83-e95c3a2e8f96","year":2025},"citing_paper":{"arxiv_id":"2604.09220","last_updated":"2026-04-10T11:26:09Z","snapshot_observed_at":"2026-08-12T21:33:05.141887Z","submitted_at":"2026-04-10T11:26:09Z","title":"TinyNeRV: Compact Neural Video Representations via Capacity Scaling, Distillation, and Low-Precision Inference","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:43.498730Z"},"links":{"cited_paper":"/paper/2510.18784","citing_paper":"/paper/2604.09220"},"observation_digest":"sha256:fea83b9e8989c89bd722a22ba37e070c48ef4c97402109b3a1f5d0d90ba0e888","observation_id":"d4bfc5ec-11e0-4893-aa30-72a15c79e29a","resolution":{"observed_at":"2026-06-19T17:11:53.086525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"cited_work":{"arxiv_id":"2510.18784","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.18784","snapshot_observed_at":"2026-06-19T17:11:53.086525Z","title":"Cage: Curvature-aware gradient estimation for accurate quantization-aware training","venue":null,"work_id":"6d5f50b2-b39e-4c96-8a83-e95c3a2e8f96","year":2025},"citing_paper":{"arxiv_id":"2605.17471","last_updated":"2026-05-17T14:20:51Z","snapshot_observed_at":"2026-08-14T15:45:28.498339Z","submitted_at":"2026-05-17T14:20:51Z","title":"WinQ: Accelerating Quantization-Aware Training of Language Models Around Saddle Points","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-20T14:53:22.233844Z"},"links":{"cited_paper":"/paper/2510.18784","citing_paper":"/paper/2605.17471"},"observation_digest":"sha256:a8a2e59536c51f6f7369805a86ce3c209914deae99347f82f37de90e7a97014e","observation_id":"e096898f-08db-494a-badf-593a2e10c5ee","resolution":{"observed_at":"2026-06-19T17:11:53.086525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2510.18784/citation-record","integrity":"/paper/2510.18784/integrity","json":"/paper/2510.18784/citation-record.json","paper":"/paper/2510.18784"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1812.04353","last_updated":"2019-08-19T23:27:28Z","snapshot_observed_at":"2026-08-18T14:03:06.621925Z","submitted_at":"2018-12-11T12:27:54Z","title":"Proximal Mean-field for Neural Network Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.04353","snapshot_observed_at":"2026-08-04T08:50:44.363956Z","title":"K., Hartley, R., and Torr, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:44.363956Z"},"links":{"cited_paper":"/paper/1812.04353","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:4501b7ca902b78aece7b4302cb0f18b9075745502c6c30b005c68cc662e34b6b","observation_id":"9ee611a2-ab37-4e09-b198-8b2ab7bf1bcc","resolution":{"observed_at":"2026-08-04T08:50:44.363956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.08153","last_updated":"2020-05-07T03:30:49Z","snapshot_observed_at":"2026-08-18T09:17:55.370547Z","submitted_at":"2019-02-21T17:31:32Z","title":"Learned Step Size Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.08153","snapshot_observed_at":"2026-08-04T08:50:45.221727Z","title":null,"venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:45.221727Z"},"links":{"cited_paper":"/paper/1902.08153","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:59c68034465e883e23625ef7fa984e6213899c737560d6f6d47cc5dd185670e6","observation_id":"998955bc-b234-451d-960a-ae836362f91a","resolution":{"observed_at":"2026-08-04T08:50:45.221727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-16T07:57:19.216626Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-04T08:50:45.441596Z","title":"org/abs/2210.17323","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:45.441596Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:f975383af12026d044906430049a471b3264f3074128ce8f1f47d49e50ec08c0","observation_id":"31eaea06-a44e-423c-be0e-879651ffcb3b","resolution":{"observed_at":"2026-08-04T08:50:45.441596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-04T08:50:45.709403Z","title":"S., Love, J., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:45.709403Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:fd923c1918ecc245fecc93384bb40b479d34b1fc94f4ea01db56437ebb793edc","observation_id":"c86ddb79-3a35-4bd4-95f9-61d93c112112","resolution":{"observed_at":"2026-08-04T08:50:45.709403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-21T02:12:10.329412Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-04T08:50:45.859379Z","title":"Hou, L., Zhang, R., and Kwok, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:45.859379Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:6adb38a83d014b0ed81e3bfc894826823bb653f7ec85f88b6c368b7a42f7fa83","observation_id":"518aca1f-c9ef-4f3c-95a5-b388ece6aa4c","resolution":{"observed_at":"2026-08-04T08:50:45.859379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15748","last_updated":"2025-03-19T23:38:49Z","snapshot_observed_at":"2026-08-18T19:38:42.668549Z","submitted_at":"2025-03-19T23:38:49Z","title":"PARQ: Piecewise-Affine Regularized Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15748","snapshot_observed_at":"2026-08-04T08:50:46.002929Z","title":"Jordan, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:46.002929Z"},"links":{"cited_paper":"/paper/2503.15748","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:ec9d0a8153130f7bfc56081a7c291c419679ec7075063d112389fa5041e53df9","observation_id":"1999f174-25df-443f-810e-d7bfc633b2c6","resolution":{"observed_at":"2026-08-04T08:50:46.002929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11035","last_updated":"2020-11-11T03:43:25Z","snapshot_observed_at":"2026-08-19T23:34:22.465614Z","submitted_at":"2020-05-22T07:11:27Z","title":"Position-based Scaled Gradient for Model Quantization and Pruning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11035","snapshot_observed_at":"2026-08-04T08:50:46.117176Z","title":"Krishnamoorthi, R","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:46.117176Z"},"links":{"cited_paper":"/paper/2005.11035","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:ecdf2499602b5cae442b150939fc1966cd0459e4e159dce7aad8b660771d276f","observation_id":"42f5d99c-c335-4679-a1cb-8d74c8e763e0","resolution":{"observed_at":"2026-08-04T08:50:46.117176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04330","last_updated":"2024-11-30T02:42:31Z","snapshot_observed_at":"2026-08-18T06:31:48.022505Z","submitted_at":"2024-11-07T00:10:10Z","title":"Scaling Laws for Precision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04330","snapshot_observed_at":"2026-08-04T08:50:46.192841Z","title":"F., Bordelon, B., Muen- nighoff, N., Paul, M., Pehlevan, C., R´e, C., and Raghu- nathan, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:46.192841Z"},"links":{"cited_paper":"/paper/2411.04330","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:0c965e80f7e56bf38ad976b1336000d87b415217287f1f7d8d5dfe2a62ffc902","observation_id":"55f10632-c74f-4610-a32d-ddbc3da57613","resolution":{"observed_at":"2026-08-04T08:50:46.192841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:50:46.378945Z","title":"Lambert, N., Morrison, J., Pyatkin, V ., Huang, S., Ivison, H., Brahman, F., Miranda, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:46.378945Z"},"links":{"citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:0dd8cc20c7ada75e9ac17e7a0c58da74314d2338c0663cdcaeb75f0c13f0bd78","observation_id":"3790ec30-dff6-4be2-abd1-c1b2db1811e6","resolution":{"observed_at":"2026-08-04T08:50:46.378945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.02880","last_updated":"2021-12-06T09:12:15Z","snapshot_observed_at":"2026-08-16T17:36:49.150185Z","submitted_at":"2021-12-06T09:12:15Z","title":"AdaSTE: An Adaptive Straight-Through Estimator to Train Binary Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.02880","snapshot_observed_at":"2026-08-04T08:50:46.535691Z","title":"K., Lin, C.-T., and Zach, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:46.535691Z"},"links":{"cited_paper":"/paper/2112.02880","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:0b02d08e7a4b2d94f5ad1f6e44eac863cf8c6ead4fac7c1ec47b19854c859621","observation_id":"064ca19a-451a-4171-b8d9-d120c93f365b","resolution":{"observed_at":"2026-08-04T08:50:46.535691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.00903","last_updated":"2021-04-02T06:34:53Z","snapshot_observed_at":"2026-08-16T18:34:18.098955Z","submitted_at":"2021-04-02T06:34:53Z","title":"Network Quantization with Element-wise Gradient Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.00903","snapshot_observed_at":"2026-08-04T08:50:46.636537Z","title":"Network quantization with element-wise gradient scaling, 2021a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:46.636537Z"},"links":{"cited_paper":"/paper/2104.00903","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:ac44cd5c984c8ab43a36b8190545a6d4729821f097e3ac639978c5d2ed19e9e8","observation_id":"6f212666-c97d-494f-8214-1c6d419d67b1","resolution":{"observed_at":"2026-08-04T08:50:46.636537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07253","last_updated":"2020-06-12T15:07:08Z","snapshot_observed_at":"2026-08-05T10:40:41.198153Z","submitted_at":"2020-06-12T15:07:08Z","title":"Dynamic Model Pruning with Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07253","snapshot_observed_at":"2026-08-04T08:50:46.729246Z","title":"Liu, L., Dong, C., Liu, X., Yu, B., and Gao, J","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:46.729246Z"},"links":{"cited_paper":"/paper/2006.07253","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:da0a55af741bede91b8327eb65b1ae59effbfb0d5a97c2b84c874982525ed202","observation_id":"cc3a75a6-2cab-4d53-a16e-f1d7a3c49565","resolution":{"observed_at":"2026-08-04T08:50:46.729246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11086","last_updated":"2022-06-28T19:58:03Z","snapshot_observed_at":"2026-08-16T17:12:57.877628Z","submitted_at":"2022-03-21T16:07:42Z","title":"Overcoming Oscillations in Quantization-Aware Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11086","snapshot_observed_at":"2026-08-04T08:50:46.805288Z","title":"net/forum?id=Bkg6RiCqY7","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:46.805288Z"},"links":{"cited_paper":"/paper/2203.11086","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:b1bf93fdd8cd23c8acd794a5320a6dd94a8ea5e6b02d4d3c1ff3eff867c88a87","observation_id":"599260c0-a2cf-4525-b515-3e5a3bd2719c","resolution":{"observed_at":"2026-08-04T08:50:46.805288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01863","last_updated":"2025-06-02T16:52:51Z","snapshot_observed_at":"2026-08-17T01:03:23.419444Z","submitted_at":"2025-06-02T16:52:51Z","title":"Unified Scaling Laws for Compressed Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01863","snapshot_observed_at":"2026-08-04T08:50:46.865250Z","title":"Panferov, A., Chen, J., Tabesh, S., Nikdan, M., and Al- istarh, D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:46.865250Z"},"links":{"cited_paper":"/paper/2506.01863","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:8955d2c943a810f6504a4efdb2fa9f07c1b1389b8901426a2a83e9f97bce2e14","observation_id":"ade1f962-833e-4933-b17e-7ac50b3ad1df","resolution":{"observed_at":"2026-08-04T08:50:46.865250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-08-14T04:51:04.817737Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-04T08:50:44.614742Z","title":"Estimating or propagating gradients through stochastic neurons for con- ditional computation.arXiv preprint arXiv:1308.3432, 2013a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:44.614742Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:73cba242bbcc30c632ad6217dbdc197e01cf756a54d679b04f59f0c38a06527c","observation_id":"47cdb6cd-7cec-4158-9a49-8e1644a1ef5e","resolution":{"observed_at":"2026-08-04T08:50:44.614742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.08237","last_updated":"2021-03-02T05:13:00Z","snapshot_observed_at":"2026-08-15T03:51:37.068037Z","submitted_at":"2019-10-18T03:19:21Z","title":"Mirror Descent View for Neural Network Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.08237","snapshot_observed_at":"2026-08-04T08:50:44.445400Z","title":null,"venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:44.445400Z"},"links":{"cited_paper":"/paper/1910.08237","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:acfe7653774dc0b0a0f78f3dd5a7f6c3c00f0cce0f149d10c1aaa9bf6c65f700","observation_id":"d820d57e-b7f0-496e-9c06-52fa78ca6095","resolution":{"observed_at":"2026-08-04T08:50:44.445400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14180","last_updated":"2021-06-15T04:41:03Z","snapshot_observed_at":"2026-08-20T09:37:18.273571Z","submitted_at":"2020-04-29T13:21:54Z","title":"Quantized Adam with Error Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14180","snapshot_observed_at":"2026-08-04T08:50:44.748754Z","title":"Quantized Adam with Error Feedback.arXiv preprint arXiv:2004.14180, 2021a","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:44.748754Z"},"links":{"cited_paper":"/paper/2004.14180","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:500ebada1d0c2289ecefc14d2b9ea5a5652855fd1d07d3835c2486bb1ecc70f2","observation_id":"be85eada-c9bc-471b-9db2-4cdc1f33bcdf","resolution":{"observed_at":"2026-08-04T08:50:44.748754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00861","last_updated":"2019-03-05T00:28:48Z","snapshot_observed_at":"2026-08-15T19:52:05.516451Z","submitted_at":"2018-10-01T17:57:02Z","title":"ProxQuant: Quantized Neural Networks via Proximal Operators","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.00861","snapshot_observed_at":"2026-08-04T08:50:44.528343Z","title":"Proxquant: Quantized neural networks via proximal operators.arXiv preprint arXiv:1810.00861,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:44.528343Z"},"links":{"cited_paper":"/paper/1810.00861","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:331f5ee83022e57cb77be1309d76c60f3e29541151d268d172c0750ec6f47343","observation_id":"7d155645-a5c9-4815-839e-8fd6a5258d73","resolution":{"observed_at":"2026-08-04T08:50:44.528343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09987","last_updated":"2022-10-17T13:29:01Z","snapshot_observed_at":"2026-08-16T18:30:14.557273Z","submitted_at":"2021-04-20T14:14:03Z","title":"Differentiable Model Compression via Pseudo Quantization Noise","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09987","snapshot_observed_at":"2026-08-04T08:50:45.091961Z","title":"Egiazarian, V ., Castro, R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:45.091961Z"},"links":{"cited_paper":"/paper/2104.09987","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:497ef1b325abd61e0832b8ff7fdaefbfe389b134e3875ed326640011960f2794","observation_id":"6ccee1b2-44c4-4c9a-a0bb-7ee525d54b1f","resolution":{"observed_at":"2026-08-04T08:50:45.091961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-04T08:50:47.018279Z","title":"Vyas, N., Morwani, D., Zhao, R., Shapira, I., Brandfon- brener, D., Janson, L., and Kakade, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:47.018279Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:fdab81c02d1bef5e2476f851586ea10b33ce3d92c0ec975c6e4ea12210bc9f9b","observation_id":"92981f24-6bea-40ca-903f-47f89db50cf3","resolution":{"observed_at":"2026-08-04T08:50:47.018279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13161","last_updated":"2025-11-30T07:03:40Z","snapshot_observed_at":"2026-08-16T12:11:22.940380Z","submitted_at":"2025-04-17T17:58:13Z","title":"Nemotron-CLIMB: CLustering-based Iterative Data Mixture Bootstrapping for Language Model Pre-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13161","snapshot_observed_at":"2026-08-04T08:50:44.869771Z","title":"Climb: Clustering-based iterative data mixture bootstrap- ping for language model pre-training.arXiv preprint arXiv:2504.13161,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:44.869771Z"},"links":{"cited_paper":"/paper/2504.13161","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:7e286aa6e5cc6a5004241219186e0682c3fc05c7e798ef0b6359e4a5ae5f8aa8","observation_id":"44609c79-2123-4fdf-8003-eac4c8516db6","resolution":{"observed_at":"2026-08-04T08:50:44.869771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-04T08:50:44.961063Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T08:50:44.961063Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2510.18784"},"observation_digest":"sha256:1d1d484c125ced970acbb00335f277cffda80ff16eca17235ea0fb205f4788e4","observation_id":"7328e217-fc2a-4e8a-b465-8509f9a5b919","resolution":{"observed_at":"2026-08-04T08:50:44.961063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.18784","last_updated":"2026-06-18T13:37:57Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T22:05:07.816899Z","submitted_at":"2025-10-21T16:33:57Z","title":"CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 3 inbound Pith citation observations for arXiv:2510.18784."}