{"as_of":"2026-08-14T12:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6523a5b6ba8bed42fe596fe546ad1908518bfb0ca64bbc22cd20480f689f9c43","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:43:45.625564Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.18313/citation-record","integrity":"/paper/2505.18313/integrity","json":"/paper/2505.18313/citation-record.json","paper":"/paper/2505.18313"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:38.262082Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:38.262082Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:6af36a54289ca335b495a2e337c63055a1a0671a24f6791a4c500050f4155e40","observation_id":"1ed2959e-4c9e-4061-9cb1-299cfa06f721","resolution":{"observed_at":"2026-08-07T14:43:38.262082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:52.775160Z","title":"Alain, A","venue":null,"work_id":"9e12d99c-c2a0-4ae1-adf3-07692c8a18d2","year":2015},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:38.332315Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:0c0d4ff2e04cbe17fbfa3836b28b8d8e0bd5af8d5b6d7f0dfbcc78f1aceb9034","observation_id":"79fbe2b3-7636-4640-83eb-0f809d785e39","resolution":{"observed_at":"2026-08-07T14:43:52.895347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:52.504086Z","title":"Banner, I","venue":null,"work_id":"84315c6f-273b-4d54-831d-59910bf9999f","year":2018},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:38.443663Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:cda940ed98b5f86a3374faad51ce50eb9b6fd57821e129ec1133009927e8d9f2","observation_id":"5f641530-0e27-4efc-aa30-4fb6a269be7f","resolution":{"observed_at":"2026-08-07T14:43:52.612511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:52.281480Z","title":"Blumenfeld, I","venue":null,"work_id":"ddbaef3e-4de2-4f63-ae61-cd512e5e1e90","year":2024},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:38.636477Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:25c2e1fc46720d088c80be3b952679fa816aa341974000b29a751cfe38f27b83","observation_id":"60ca68b1-fb0f-4892-8893-38743db61832","resolution":{"observed_at":"2026-08-07T14:43:52.374038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:38.847898Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:38.847898Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:9b79b629ba772d9faae3a9150ac7d5f3f332fcb213de9e69b2fd45b934b52cc4","observation_id":"3db2a9b2-61f6-49f4-9d6a-f6fcd4a6bfe4","resolution":{"observed_at":"2026-08-07T14:43:38.847898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:52.063463Z","title":"Chmiel, L","venue":null,"work_id":"8bd330f3-a4f3-4760-a404-c5aecef3f04e","year":2020},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:39.036210Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:b7f5f4c3e4fd00ac326e3e295bc77131d1ac0cdd43e514f2be4c7955db90e5e5","observation_id":"b3ecf528-6872-4862-abd0-8b10f368e78a","resolution":{"observed_at":"2026-08-07T14:43:52.205543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:51.897755Z","title":"Chmiel, I","venue":null,"work_id":"3c85c8d0-d24c-409f-a09f-fefedd92380b","year":2022},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:39.244669Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:9021bbf50d14fb3a6304356001d538038440ce44be26563c59101ce8e90c7abc","observation_id":"1c790c67-9627-4923-adbd-1d8e54c2be58","resolution":{"observed_at":"2026-08-07T14:43:51.984025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:51.647187Z","title":"Courbariaux, I","venue":null,"work_id":"920ce4ba-c919-425e-8cbf-3de1e02a4b47","year":2016},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:39.453165Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:9883308cb0810988ae813b1ee390536c5d3e67170849a39a67582ccb08bccb9c","observation_id":"aaebadec-c6f8-4e36-aac8-447a5ef2f392","resolution":{"observed_at":"2026-08-07T14:43:51.790884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:51.380936Z","title":"Dettmers, M","venue":null,"work_id":"f0063b50-7c50-4992-a101-1fe7b50b60a9","year":2021},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:39.602546Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:4991e337987b41b85dacf57158cf21f027e6bdb6b397631a6430369baf2f5ce7","observation_id":"21df317e-bb59-4ed1-954d-97e4816b4ffc","resolution":{"observed_at":"2026-08-07T14:43:51.462261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-08-13T23:56:42.354755Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-07T14:43:39.758214Z","title":"Dettmers, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:39.758214Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:fda858a1a831be48f28c3997cee0c6169a0eb1b1ac828c9a583a10ae5c0301a0","observation_id":"8d45acbb-aae7-40db-b002-395518fea2a4","resolution":{"observed_at":"2026-08-07T14:43:39.758214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:51.116094Z","title":"Eckart and G","venue":null,"work_id":"a37e6113-dfce-400c-85ce-7ecf1fb223ca","year":1936},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:39.978858Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:94c48cf51c9a4f4c8f8d2c220ac9e65ff5111cbb50e4226960ee96dc212bcab6","observation_id":"f531dac4-2a29-4f70-be9e-f7274d5fdcfb","resolution":{"observed_at":"2026-08-07T14:43:51.251691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:50.921998Z","title":null,"venue":null,"work_id":"440650fd-d994-4804-8216-d12c62ff5869","year":2024},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:40.147915Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:3cbd66da63e713608f9fb351ec32c33bb94052e7c2686dd31c26369cc196128f","observation_id":"da698db8-1bb6-4e90-901f-6ff1ff1ff9a0","resolution":{"observed_at":"2026-08-07T14:43:51.035796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:50.739687Z","title":null,"venue":null,"work_id":"b4e0272b-6c8b-4982-8e03-e63ddc0b3bf1","year":2020},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:40.355590Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:d023233c45f1c9f3b4830faf8e74b9c93feea73da6e50162531294e72b4f8b94","observation_id":"9dd77c39-0bea-46fc-9d23-bdc0b4dd04e5","resolution":{"observed_at":"2026-08-07T14:43:50.832922Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:40.567842Z","title":"Gholami, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:40.567842Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:9a89ca9334e911db991efc725718d6ab827aea79637b7c2abe0ac349d6840091","observation_id":"f9114857-b9ed-426d-906c-c1c303b53b57","resolution":{"observed_at":"2026-08-07T14:43:40.567842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:50.399719Z","title":"Gupta, T","venue":null,"work_id":"3c43788b-664e-4e51-a9d3-54928c6a1af9","year":2018},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:40.793469Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:7bd6e6095b977e697ff548f8cca60b991390f8b675b38418461abd30fb62778c","observation_id":"3dae5d4a-ad97-46a1-8cb4-b36401e82519","resolution":{"observed_at":"2026-08-07T14:43:50.545133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:50.090146Z","title":null,"venue":null,"work_id":"ec5dcce0-650c-42ab-9f5f-c3ef9fd0f9b9","year":2024},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:40.982661Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:9a374d611c02657066026a52af5ce03fd6c2dd2bd9cfa5c5b376de1128d21fb0","observation_id":"dcff535c-3ffd-4171-8e78-507ba79171e4","resolution":{"observed_at":"2026-08-07T14:43:50.245970Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:41.142420Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:41.142420Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:4f58e8b0c717ea3c627c934b0530565fa1c6dca36ac7efd643b9e44ea96ac8fd","observation_id":"7f696729-6dc9-48d3-be2a-f29aa33d14fd","resolution":{"observed_at":"2026-08-07T14:43:41.142420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:49.784476Z","title":"Hubara, B","venue":null,"work_id":"d3874fa3-b90c-457a-af3e-ba3222e605d9","year":2021},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:41.350980Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:b23d2ee95a523e942c52d0249a6b27bb9a927df384681146751d07914318157e","observation_id":"b6f99f84-1b87-4d16-b8e1-edb8d57f2929","resolution":{"observed_at":"2026-08-07T14:43:49.926822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.07172","last_updated":"2018-08-22T01:04:07Z","snapshot_observed_at":"2026-07-06T06:56:47.028805Z","submitted_at":"2018-08-22T01:04:07Z","title":"Fisher Information and Natural Gradient Learning of Random Deep Networks","version":1},"cited_work":{"arxiv_id":"1808.07172","doi":null,"metadata_source":"pith","pith_arxiv_id":"1808.07172","snapshot_observed_at":"2026-08-07T14:43:46.033231Z","title":"Fisher Information and Natural Gradient Learning of Random Deep Networks","venue":"cs.LG","work_id":"a61b3966-63e4-4ddc-a64e-45af4e64057a","year":2018},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:41.523443Z"},"links":{"cited_paper":"/paper/1808.07172","citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:26fe6081b91589339a5d6301212ce0448fb358455493d590bef089bc24e445a4","observation_id":"1d085a24-3011-4df8-9500-deaf8fc11b27","resolution":{"observed_at":"2026-08-07T14:43:46.164540Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T14:43:41.716938Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:41.716938Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:32dbf8b1ac007cd5f76d2b55f022eb23afe19f9136e5ee6d656eb3225d891636","observation_id":"b52d9219-c7cb-47dd-abfb-1afd9fa26c9a","resolution":{"observed_at":"2026-08-07T14:43:41.716938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:49.495338Z","title":"Liang, B","venue":null,"work_id":"e7752004-acba-47d6-a489-a3466d5fa2a8","year":2024},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:41.871697Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:55862f71b056d77652c9223483aa3869095163c7035c42c5ff9bc17f90966c94","observation_id":"f19d4351-199b-4452-b1e2-5e3e6c3c10b0","resolution":{"observed_at":"2026-08-07T14:43:49.627566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:49.149506Z","title":null,"venue":null,"work_id":"d37b2912-e819-4166-acfb-37828536f663","year":2024},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:42.143812Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:08f6c55a1bc66ee86edb4d7a6acec19ffc368fa0e7554650f9dba2bc9a0c6185","observation_id":"80e01210-5bd9-4f5e-8feb-39d81f137364","resolution":{"observed_at":"2026-08-07T14:43:49.265591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T14:43:42.313905Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:42.313905Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:713ffd4c4b6af7ec8d8538b195ee05ed6cfcd0f17ae7b238e678295aac23296c","observation_id":"85856a4c-2ee2-40da-970a-a64273ffe401","resolution":{"observed_at":"2026-08-07T14:43:42.313905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17660","last_updated":"2024-06-25T15:50:32Z","snapshot_observed_at":"2026-08-13T17:22:42.383468Z","submitted_at":"2024-06-25T15:50:32Z","title":"Grass: Compute Efficient Low-Memory LLM Training with Structured Sparse Gradients","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17660","snapshot_observed_at":"2026-08-07T14:43:42.491956Z","title":"Muhamed, O","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:42.491956Z"},"links":{"cited_paper":"/paper/2406.17660","citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:01a3fb211b65efef352c3777d07d5d5b5d799c8e6d161726734d3daec8f94031","observation_id":"8211329e-85a8-4282-82da-d55948a924ab","resolution":{"observed_at":"2026-08-07T14:43:42.491956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:48.804648Z","title":"Raffel, N","venue":null,"work_id":"e5079ba5-1a2d-4366-9b0e-255886c8199f","year":2019},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:42.643214Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:03139b9127e66b5d732b9b901f3d44ef5de526042143d95cf91cbbf3437c633c","observation_id":"92751dd3-35ac-495a-ab50-7056f2743ba9","resolution":{"observed_at":"2026-08-07T14:43:48.983996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1405.2020","last_updated":"2014-05-08T17:04:15Z","snapshot_observed_at":"2026-08-04T16:50:32.529025Z","submitted_at":"2014-05-08T17:04:15Z","title":"Generalized Slow Roll for Tensors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1405.2020","snapshot_observed_at":"2026-08-07T14:43:42.790102Z","title":"Rajbhandari, J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:42.790102Z"},"links":{"cited_paper":"/paper/1405.2020","citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:033e3cf1ca42ccd9bfd1d6c56c3ae900f1593ee0cf7cc65323e3c1cb28a8a57c","observation_id":"1279f405-c53d-4599-b955-d79c986c2613","resolution":{"observed_at":"2026-08-07T14:43:42.790102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:48.450997Z","title":null,"venue":null,"work_id":"58f18d72-7dda-4bfe-94a4-34a484cefe53","year":1986},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:43.024425Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:aaec44b178f921ad77aead8da27c0912294d39478caf44026ec79992cced494c","observation_id":"f062aa61-5d66-4c0d-8289-39444d65f1fd","resolution":{"observed_at":"2026-08-07T14:43:48.596530Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15352","last_updated":"2025-02-08T21:27:02Z","snapshot_observed_at":"2026-08-12T22:19:15.171773Z","submitted_at":"2024-10-20T10:24:38Z","title":"CompAct: Compressed Activations for Memory-Efficient LLM Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15352","snapshot_observed_at":"2026-08-07T14:43:43.192620Z","title":"Shamshoum, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:43.192620Z"},"links":{"cited_paper":"/paper/2410.15352","citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:bed3f23b59b4e1e62855aa9bdbd6b8977ccb05a379f77e8a4296f238b48db40b","observation_id":"b76d4d78-1879-481c-b4a7-0cf5fd46866a","resolution":{"observed_at":"2026-08-07T14:43:43.192620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:43.360427Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:43.360427Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:7d4f04343ffef7d13a0c55523f7027f89ba994bb19429124d9674f1779c503e4","observation_id":"3774c1c6-4f7d-4070-9a70-722df2b51125","resolution":{"observed_at":"2026-08-07T14:43:43.360427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:48.095088Z","title":"Shazeer and M","venue":null,"work_id":"81c2495b-04bb-47ff-98b0-582471a9a8e6","year":2018},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:43.581919Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:197cc4535f07bb9e15bb669d396a612a496baba03c6a9d2e7aae8f2f802b2b32","observation_id":"ee53e55d-e786-44cd-9afd-04e3156b063a","resolution":{"observed_at":"2026-08-07T14:43:48.306425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:43.738303Z","title":"Shoeybi, M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:43.738303Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:812f4b0b1b722288dac6a5ce8848d5b057bee354ad9bec04778a48c0c076c384","observation_id":"44193c96-6fb0-487d-a1de-9f90108416df","resolution":{"observed_at":"2026-08-07T14:43:43.738303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T14:43:43.913166Z","title":"Touvron, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:43.913166Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:cefd8525679d29695be440211a90683b48557771256f7cbd79791bba702b0601","observation_id":"6bdf57ce-3015-44a1-a2f8-ca4dc1f79341","resolution":{"observed_at":"2026-08-07T14:43:43.913166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.13727","last_updated":"2020-02-18T14:13:56Z","snapshot_observed_at":"2026-08-12T13:09:36.627906Z","submitted_at":"2019-05-31T17:25:13Z","title":"PowerSGD: Practical Low-Rank Gradient Compression for Distributed Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13727","snapshot_observed_at":"2026-08-07T14:43:44.070097Z","title":"V ogels, S","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:44.070097Z"},"links":{"cited_paper":"/paper/1905.13727","citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:4c3193d63d6a7a9d17e46e8fd8d79548e74ae22f1fbd3e457f78bfb39738f5f3","observation_id":"fcd2b92b-4813-47a1-a2ff-8fe54a95d3a0","resolution":{"observed_at":"2026-08-07T14:43:44.070097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:47.706892Z","title":null,"venue":null,"work_id":"30810978-29e4-4276-af47-20a92929bf04","year":2024},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:44.175143Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:300c3efe3aecdb1a4417809d684919cfbf2875d7f15be68101164a0bb60390c1","observation_id":"0938994a-5df7-4561-b4aa-1172e68b441d","resolution":{"observed_at":"2026-08-07T14:43:47.930373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-07T14:43:44.366275Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:44.366275Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:9bb7afc23498f484db76bd71c5bac6fc25441200efcb4f3179d5873425072a04","observation_id":"46368c54-ea9e-41ef-ae8d-bba059950516","resolution":{"observed_at":"2026-08-07T14:43:44.366275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:47.348799Z","title":null,"venue":null,"work_id":"d5853c1e-66cd-4732-bd10-14676317d239","year":2018},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:44.582885Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:1bc433e74a4da8aac95ef378fb1e26fdcaf1a63f2331ffe0cf857d59daeae3fc","observation_id":"d80d13f7-b983-4ee7-a04e-32894bae1f33","resolution":{"observed_at":"2026-08-07T14:43:47.549644Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:46.972783Z","title":null,"venue":null,"work_id":"0d720598-fa5e-4e10-893d-09018a444803","year":2019},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:44.814480Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:673b03c35ad105a7017371eaff1bd9afba7c377de060bcd7b9c03cd4c38d7dba","observation_id":"8ec9799e-9f75-449d-a876-90dbbed27c1e","resolution":{"observed_at":"2026-08-07T14:43:47.125686Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:46.636760Z","title":"Zhang and R","venue":null,"work_id":"1033148c-9d98-4cbf-a48d-3ac5761a8504","year":2019},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:45.034470Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:8927d580a46c7c55ad8416ec460ef17f0f1cb682d90617909d94de7b22b54a9c","observation_id":"2f1dc57f-e589-4601-b75d-6e02b6c61f61","resolution":{"observed_at":"2026-08-07T14:43:46.817413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:46.378471Z","title":null,"venue":null,"work_id":"b1f76882-5e44-4bb3-ac5a-6a4ce335fce0","year":2024},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:45.269107Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:94475f23fb74f77ce1ba049b00fd464f823d24189a55e3938c1ecd15b7e9627b","observation_id":"dc3220b1-a3dd-4541-883a-7357589c6206","resolution":{"observed_at":"2026-08-07T14:43:46.473591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:45.479345Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:45.479345Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:5092b97d81cfb4ca151722ad76fac537c4731e8f400f4378ec1d9f8b333363df","observation_id":"a84ec5ba-a1c1-4656-9e9b-01de0d381f74","resolution":{"observed_at":"2026-08-07T14:43:45.479345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:43:45.625564Z","title":"Zhu and A","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:43:45.625564Z"},"links":{"citing_paper":"/paper/2505.18313"},"observation_digest":"sha256:d02ebde85f21de8593f4b9e48328e939c9e3dbf2b42f1d853be91b50257c804e","observation_id":"cac4d566-925b-4e0d-b735-e3cba7155954","resolution":{"observed_at":"2026-08-07T14:43:45.625564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.18313","last_updated":"2025-05-23T19:17:55Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T21:10:08.165033Z","submitted_at":"2025-05-23T19:17:55Z","title":"PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":1,"verified_fuzzy":14},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2505.18313."}